Views
No views yet
4f37f51)
的 convert_hf_to_gguf.py + llama-quantize 產生。
量化 pipeline 原始碼:gguf-quantization-factory。-ngl 99).| 量化 Quant | 大小 Size | PPL ↓ | ΔPPL vs F16 | pp512 tok/s | tg128 tok/s | 峰值 VRAM | 檔案 File |
|---|---|---|---|---|---|---|---|
| F16 | 5.75 GiB | 9.0631 | 基準 baseline | 19999.59 | 127.83 | 8698 MiB | —(未上傳 not uploaded) |
| Q8_0 | 3.06 GiB | 9.0806 | +0.19% | 22389.26 | 206.78 | 5888 MiB | Qwen2.5-3B-Instruct-Q8_0.gguf |
| Q5_K_M | 2.07 GiB | 9.1883 | +1.38% | 20976.91 | 270.39 | 4630 MiB | Qwen2.5-3B-Instruct-Q5_K_M.gguf |
| Q4_K_M | 1.80 GiB | 9.5741 | +5.64% | 19691.23 | 300.21 | 4348 MiB | Qwen2.5-3B-Instruct-Q4_K_M.gguf |
| Q4_K_M_IMAT | 1.80 GiB | 9.3241 | +2.88% | 21121.76 | 302.57 | 4299 MiB | Qwen2.5-3B-Instruct-Q4_K_M_IMAT.gguf |
| Q4_K_M_ZHTW | 1.80 GiB | 9.2671 | +2.25% | 20469.41 | 289.34 | 4295 MiB | Qwen2.5-3B-Instruct-Q4_K_M_ZHTW.gguf |
| IQ4_XS | 1.62 GiB | 9.3713 | +3.40% | 21769.35 | 303.62 | 4128 MiB | Qwen2.5-3B-Instruct-IQ4_XS.gguf |
| IQ4_XS_ZHTW | 1.62 GiB | 9.3731 | +3.42% | 21919.70 | 295.07 | 4120 MiB | Qwen2.5-3B-Instruct-IQ4_XS_ZHTW.gguf |
| IQ3_M | 1.39 GiB | 9.9827 | +10.15% | 22226.49 | 341.54 | 3620 MiB | Qwen2.5-3B-Instruct-IQ3_M.gguf |
| IQ3_S | 1.36 GiB | 9.9546 | +9.84% | 21605.76 | 338.30 | 3627 MiB | Qwen2.5-3B-Instruct-IQ3_S.gguf |
| IQ3_XS | 1.30 GiB | 10.0373 | +10.75% | 21557.88 | 350.32 | 3536 MiB | Qwen2.5-3B-Instruct-IQ3_XS.gguf |
| IQ3_XXS | 1.19 GiB | 10.5463 | +16.36% | 21914.09 | 354.49 | 3660 MiB | Qwen2.5-3B-Instruct-IQ3_XXS.gguf |
| IQ2_M | 1.06 GiB | 12.5399 | +38.36% | 19803.65 | 338.97 | 11007 MiB | —(未上傳 not uploaded) |
| IQ2_S | 0.99 GiB | 14.3376 | +58.20% | 18590.73 | 338.72 | 11122 MiB | —(未上傳 not uploaded) |
| IQ2_XS | 0.96 GiB | 15.5602 | +71.69% | 19556.77 | 344.39 | 11078 MiB | —(未上傳 not uploaded) |
| IQ2_XXS | 0.88 GiB | 23.9641 | +164.41% | 22406.26 | 365.61 | 10991 MiB | —(未上傳 not uploaded) |
1# 直接從 Hugging Face 跑(Ollama ≥ 0.3.34)
2ollama run hf.co/betty0/Qwen2.5-3B-Instruct-GGUF:Q4_K_Mollama/Modelfile。1# 下載
2hf download betty0/Qwen2.5-3B-Instruct-GGUF Qwen2.5-3B-Instruct-Q4_K_M.gguf --local-dir .
3
4# 互動對話(全部層放 GPU)
5llama-cli -m Qwen2.5-3B-Instruct-Q4_K_M.gguf -ngl 99 -cnv