Views
No views yet
HelpingAI/HelpingAI2.5-5B using llama.cpp via the ggml.ai's all-gguf-same-where space.
Refer to the original model card for more details on the model.Q4_K_M | ⚡ Recommended for ARM CPU: Q4_0 | 🏆 Best Quality: Q8_0| 🚀 Download | 🔢 Type | 📝 Notes |
|---|---|---|
| Download | Basic quantization | |
| Download | Small size | |
| Download | Balanced quality | |
| Download | Better quality | |
| Download | Fast on ARM | |
| Download | Fast, recommended | |
| Download | Best balance | |
| Download | Good quality | |
| Download | Balanced | |
| Download | High quality | |
| Download | Very good quality | |
| Download | Fast, best quality | |
| Download | Maximum accuracy |
F16 for maximum precision when quality is critical