Views
No views yet
| Quantization | Size | Description |
|---|---|---|
| Q4_K_M | ~40% of original | Best balance of quality and size |
| Q5_K_M | ~50% of original | Higher quality, larger size |
| Q8_0 | ~80% of original | Highest quality quantization |
1# Pull and run directly from HuggingFace
2ollama pull hf.co/ermiaazarkhalili/Qwen3-0.6B-SFT-UltraChat-GGUF:Q4_K_M
3ollama run hf.co/ermiaazarkhalili/Qwen3-0.6B-SFT-UltraChat-GGUF:Q4_K_M "Hello!"1# Download the GGUF file
2huggingface-cli download ermiaazarkhalili/Qwen3-0.6B-SFT-UltraChat-GGUF \
3 qwen3_0.6b_sft_ultrachat-q4_k_m.gguf --local-dir ./models
4
5# Run inference
6./llama-cli -m ./models/qwen3_0.6b_sft_ultrachat-q4_k_m.gguf \
7 -p "What is the capital of France?" -n 1281@misc{azarkhalili2026_qwen3_0_6b_sft_ultrachat_gguf,
2 author = {Azarkhalili, Behrooz},
3 title = {Qwen3-0.6B-SFT-UltraChat-GGUF},
4 year = {2026},
5 publisher = {Hugging Face},
6 url = {https://huggingface.co/ermiaazarkhalili/Qwen3-0.6B-SFT-UltraChat-GGUF}
7}To generate a citable DOI, click "Cite this model" on the model page.