Views
No views yet
llama-cli -hf liodon-ai/MaralGPT-Mythos-9B-2606-GGUF-imatrix-GGUF:Q4_K_Mollama run hf.co/liodon-ai/MaralGPT-Mythos-9B-2606-GGUF-imatrix-GGUF:Q4_K_Mliodon-ai/MaralGPT-Mythos-9B-2606-GGUF-imatrix-GGUF and pick your quant.| Quant | Size | VRAM est. | Notes |
|---|---|---|---|
IQ2_M | 3.61 GB | ~4 GB | 2-bit, iMatrix — smallest usable |
IQ3_M | 4.42 GB | ~5 GB | 3-bit, iMatrix — great quality/size tradeoff |
IQ4_XS | 5.20 GB | ~6 GB | 4-bit extra-small, iMatrix |
Q4_K_M | 5.63 GB | ~6 GB | 4-bit, iMatrix-calibrated (recommended) |
Q5_K_M | 6.47 GB | ~7 GB | 5-bit, iMatrix-calibrated |
Q6_K | 7.36 GB | ~8 GB | 6-bit, iMatrix-calibrated, near-lossless |
Q8_0 | 9.53 GB | ~11 GB | 8-bit, essentially lossless |
Also see plain (non-iMatrix) quants:liodon-ai/MaralGPT-Mythos-9B-2606-GGUF-GGUF