Views
No views yet
| File Name | Target BPW | VRAM Fit | Optimization Strategy |
|---|---|---|---|
| Qwen-3.5-27B-Opus-Reasoning-Abliterated-EP3.5_bpw.gguf | 3.5 | 12GB - 16GB | Q3_K Base + F32 Mamba/Norms |
| Qwen-3.5-27B-Opus-Reasoning-Abliterated-EP4.25_bpw.gguf | 4.25 | 16GB - 24GB | Q4_K Base + F32 Mamba/Norms |
| Qwen-3.5-27B-Opus-Reasoning-Abliterated-EP5.0_bpw.gguf | 5.0 | 24GB+ | Q5_K Base + F32 Mamba/Norms |
| File | Type | Size |
|---|---|---|
| Qwen-3.5-27B-Opus-Reasoning-Abliterated-Q2_K.gguf | Q2_K | ~10 GB |
| Qwen-3.5-27B-Opus-Reasoning-Abliterated-Q3_K.gguf | Q3_K | ~13 GB |
| Qwen-3.5-27B-Opus-Reasoning-Abliterated-Q4_K.gguf | Q4_K | ~16 GB |
| Qwen-3.5-27B-Opus-Reasoning-Abliterated-Q5_K.gguf | Q5_K | ~19 GB |
| Qwen-3.5-27B-Opus-Reasoning-Abliterated-Q6_K.gguf | Q6_K | ~23 GB |
gptq-gguf-toolkit for Mamba-aware layer mapping.llama.cpp (March 2026+) for full Hybrid Mamba support.