Views
No views yet



INT4 for non-Blackwell GPUs (pre-50-series), NVFP4 for Blackwell GPUs (50-series).
Rank: r32 for faster inference, r128 for better quality but slower inference.| Data Type | Rank | Model Name | Comment |
|---|---|---|---|
| INT4 | r32 | svdq-int4_r32-qwen-image.safetensors | |
| r128 | svdq-int4_r128-qwen-image.safetensors | ||
| NVFP4 | r32 | svdq-fp4_r32-qwen-image.safetensors | |
| r128 | svdq-fp4_r128-qwen-image.safetensors |
| Data Type | Rank | Model Name | Comment |
|---|---|---|---|
| INT4 | r32 | svdq-int4_r32-qwen-image-lightningv1.0-4steps.safetensors | Fused with Qwen-Image-Lightning-4steps-V1.0 LoRA |
| r128 | svdq-int4_r128-qwen-image-lightningv1.0-4steps.safetensors | Fused with Qwen-Image-Lightning-4steps-V1.0 LoRA. Better quality, slower inference | |
| NVFP4 | r32 | svdq-fp4_r32-qwen-image-lightningv1.0-4steps.safetensors | Fused with Qwen-Image-Lightning-4steps-V1.0 LoRA |
| r128 | svdq-fp4_r128-qwen-image-lightningv1.0-4steps.safetensors | Fused with Qwen-Image-Lightning-4steps-V1.0 LoRA. Better quality, slower inference |
| Data Type | Rank | Model Name | Comment |
|---|---|---|---|
| INT4 | r32 | svdq-int4_r32-qwen-image-lightningv1.1-8steps.safetensors | Fused with Qwen-Image-Lightning-8steps-V1.1 LoRA |
| r128 | svdq-int4_r128-qwen-image-lightningv1.1-8steps.safetensors | Fused with Qwen-Image-Lightning-8steps-V1.1 LoRA. Better quality, slower inference | |
| NVFP4 | r32 | svdq-fp4_r32-qwen-image-lightningv1.1-8steps.safetensors | Fused with Qwen-Image-Lightning-8steps-V1.1 LoRA |
| r128 | svdq-fp4_r128-qwen-image-lightningv1.1-8steps.safetensors | Fused with Qwen-Image-Lightning-8steps-V1.1 LoRA. Better quality, slower inference |

1@inproceedings{
2 li2024svdquant,
3 title={SVDQuant: Absorbing Outliers by Low-Rank Components for 4-Bit Diffusion Models},
4 author={Li*, Muyang and Lin*, Yujun and Zhang*, Zhekai and Cai, Tianle and Li, Xiuyu and Guo, Junxian and Xie, Enze and Meng, Chenlin and Zhu, Jun-Yan and Han, Song},
5 booktitle={The Thirteenth International Conference on Learning Representations},
6 year={2025}
7}