Views
No views yet
| Name | Quant Method | Size | Color | Description |
|---|---|---|---|---|
| [model-f16.gguf] | None | 2.88 GB | 🟢 | Full precision, maximum accuracy. |
| [model-q8_0.gguf] | Q8_0 | ~1.60 GB | 🔵 | Near-lossless, recommended for high-end use. |
| [model-q4_k_m.gguf] | Q4_K_M | ~1.00 GB | 🟣 | Recommended. Best balance of speed/logic. |
./llama-cli -m qwen2.5-1.5b-Q4_K_M.gguf -p "<|im_start|>user\n小明有5个苹果,吃了2个,还剩几个?<|im_end|>\n<|im_start|>assistant\n"