Views
No views yet
llama-cli -hf liodon-ai/LocateAnything-3B-imatrix-GGUF:Q4_K_Mliodon-ai/LocateAnything-3B-imatrix-GGUF and pick your quant.| Quant | Size | VRAM | Notes |
|---|---|---|---|
IQ2_M | 1.28 GB | 2 GB | ultra-tiny + iMatrix — better than standard Q2 |
IQ3_M | 1.62 GB | 2.5 GB | tiny + iMatrix — sharper than standard Q3 |
IQ4_XS | 1.91 GB | 3 GB | small + iMatrix — rivals Q5 at Q4 size |
Q2_K | 1.38 GB | 2 GB | tiniest standard — runs almost anywhere, iMatrix-improved |
Q3_K_M | 1.73 GB | 2.5 GB | great for 4GB VRAM, iMatrix-improved |
Q4_K_M | 2.11 GB | 3 GB | sweet spot (recommended), iMatrix-improved |
Q5_K_M | 2.44 GB | 4 GB | high quality, iMatrix-improved |
Q6_K | 2.80 GB | 4 GB | near-lossless, iMatrix-improved |
Q8_0 | 3.62 GB | 5 GB | basically full quality |