Views
No views yet
| Quantization | File Size | Use Case | VRAM Required |
|---|---|---|---|
| Q4_K_M | ~2.5GB | Recommended for most users | ~4GB |
| Q5_K_M | ~3.0GB | Better quality, still efficient | ~5GB |
| Q8_0 | ~4.5GB | High quality | ~6GB |
| FP16 | ~8GB | Full quality (for testing) | ~10GB |
1@misc{strix-xss-qwen3-rl-gguf,
2 author = {oyasumi},
3 title = {Strix-XSS-Qwen3-4B-RL: GGUF Quantized Models},
4 year = {2025},
5 publisher = {HuggingFace},
6 howpublished = {\url{https://huggingface.co/kusonooyasumi/strix-xss-qwen3-4b-rl-gguf}}
7}