Views
No views yet
| Quant | Quality | Speed | RAM Usage | Recommended For |
|---|---|---|---|---|
| F16 | Best | Slow | High | Benchmark / Fine-tune |
| Q8_0 | Excellent | Medium | Medium-High | High-end GPU |
| Q4_K_M | Very Good | Fast | Medium | Daily usage ⭐ |
| Q4_K_S | Good | Very Fast | Low | Laptop / Edge device |
1ChindaMT-4B-F16.gguf
2ChindaMT-4B-Q8_0.gguf
3ChindaMT-4B-Q4_K_M.gguf
4ChindaMT-4B-Q4_K_S.gguf1./llama-cli \
2 -m ChindaMT-4B-Q4_K_M.gguf \
3 -p "สวัสดี ช่วยอธิบาย quantum computing แบบง่าย"1./llama-server \
2 -m ChindaMT-4B-Q4_K_M.gguf \
3 --host 0.0.0.0 \
4 --port 8080FROM ./ChindaMT-4B-Q4_K_M.ggufollama create chindamt -f Modelfileollama run chindamt.ggufQ4_K_M for most usersQ8_0 if you have more VRAM| Quant | Recommended RAM |
|---|---|
| Q4_K_S | 6GB+ |
| Q4_K_M | 8GB+ |
| Q8_0 | 12GB+ |
| F16 | 16GB+ |