Views
No views yet
| Variant | VFM backbone (decoder config) | Latent dim | Input size |
|---|---|---|---|
pae-dinov2-large-d32 | DINOv2-L (with registers) | 32 | 224 |
pae-dinov3-large-d32 | DINOv3-ViT-L/16 | 32 | 256 |
pae-mae-large-d32 | MAE-L | 32 | 256 |
pae-siglip2-so400m-d32 | SigLIP2-SO400M | 32 | 256 |
1model_index.json
2pipeline.py
3scheduler/scheduling_flow_match_pae.py
4transformers/transformer_lightning_dit.py
5decoder/decoder_pae.py
6decoder/diffusion_pytorch_model.safetensors1from pathlib import Path
2import torch
3from diffusers import DiffusionPipeline
4
5model_dir = Path("/home/czy/local/models/BiliSakura/PAE-diffusers/pae-dinov2-large-d32").resolve()
6pipe = DiffusionPipeline.from_pretrained(
7 str(model_dir),
8 local_files_only=True,
9 custom_pipeline=str(model_dir / "pipeline.py"),
10 trust_remote_code=True,
11 torch_dtype=torch.bfloat16,
12).to("cuda")
13
14print(pipe.get_label_ids("golden retriever"))