Views
No views yet
awq-int4-flux.1-t5xxl.safetensors: AWQ quantized W4A16 T5-XXL model for FLUX.1.1@inproceedings{
2 li2024svdquant,
3 title={SVDQuant: Absorbing Outliers by Low-Rank Components for 4-Bit Diffusion Models},
4 author={Li*, Muyang and Lin*, Yujun and Zhang*, Zhekai and Cai, Tianle and Li, Xiuyu and Guo, Junxian and Xie, Enze and Meng, Chenlin and Zhu, Jun-Yan and Han, Song},
5 booktitle={The Thirteenth International Conference on Learning Representations},
6 year={2025}
7}
8@inproceedings{
9 lin2023awq,
10 title={AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration},
11 author={Lin, Ji and Tang, Jiaming and Tang, Haotian and Yang, Shang and Chen, Wei-Ming and Wang, Wei-Chen and Xiao, Guangxuan and Dang, Xingyu and Gan, Chuang and Han, Song},
12 booktitle={MLSys},
13 year={2024}
14}