Views
No views yet
| Quant | Bits | Size | Notes |
|---|---|---|---|
| Q4_K_M | 4 | ~235 MB | Average quality |
| Q5_K | 5 | ~280 MB | High quality |
| Q6_K | 6 | ~326 MB | Very high quality |
| Q8_0 | 8 | ~421 MB | Highest quality, near lossless, Recommended |
| BF16 | 16 | ~771 MB | Full precision, reference file |
config if using llama-server:1[Qwen3.6-35B-A3B-Q8_0-DFlash]
2model = /mnt/gguf/Qwen3.6-35B-A3B/Qwen3.6-35B-A3B-Q8_0.gguf
3model-draft = /mnt/gguf/Qwen3.6-35B-A3B/Qwen3.6-35B-A3B-DFlash-Q8_0.gguf
4spec-type = draft-dflash
5spec-draft-n-max = 6