Views
No views yet

| Metric | FP8 | NVFP4 | Speedup |
|---|---|---|---|
| Model size | 5.8 GB | 3.5 GB | 1.7× smaller |
| Inference (50 steps) | 96.5s | 56.5s | 1.71× |
| Inference (4 steps distill) | ~8s | ~5s | ~1.6× |
| Original BF16 | 11.5 GB | — | 3.3× smaller |
z-anime-distill-4step-nvfp4.safetensors — Distilled 4-step model (recommended for speed)z-anime-base-nvfp4.safetensors — Base model, 28–50 steps with CFGComfyUI/models/diffusion_models/defaultqwen_3_4b.safetensors, type: qwen_imageeuler_ancestral / beta
| Parameter | Value |
|---|---|
| Steps | 4 |
| CFG | 1.0 |
| Sampler | euler_ancestral |
| Scheduler | beta |
| Shift | 3.5 |
| Parameter | Value |
|---|---|
| Steps | 28–50 |
| CFG | 3.0–5.0 |
| Sampler | euler_ancestral |
| Scheduler | beta |
| Shift | 3.5 |
comfy_kitchen.quantize_nvfp4() with per-tensor scaling + 16× block padding