Views
No views yet
qwen35moe architecture. Robinson Labs then abliterated the pruned model
and quantized it here.nextn layer carrying no weights, so our convert produced a clean 48-layer
model (block_count=48). These are standard single-token-prediction GGUFs.not-for-all-audiences. Use responsibly - you are responsible for
your use. License inherited from the base model: Apache-2.0.| File | Quant | Size | Notes |
|---|---|---|---|
Qwen3.5-122B-A10B-REAP-20-abliterated-Q6_K.gguf | Q6_K | 81.3 GB | near-lossless |
Qwen3.5-122B-A10B-REAP-20-abliterated-Q5_K_M.gguf | Q5_K_M | 70.4 GB | |
Qwen3.5-122B-A10B-REAP-20-abliterated-Q4_K_M.gguf | Q4_K_M | 60.2 GB | |
Qwen3.5-122B-A10B-REAP-20-abliterated-Q4_K_S.gguf | Q4_K_S | 56.5 GB | |
Qwen3.5-122B-A10B-REAP-20-abliterated-IQ4_XS.gguf | IQ4_XS | 53.2 GB | quality/size sweet spot |
Qwen3.5-122B-A10B-REAP-20-abliterated-Q3_K_M.gguf | Q3_K_M | 47.6 GB | |
Qwen3.5-122B-A10B-REAP-20-abliterated-IQ3_M.gguf | IQ3_M | 43.7 GB | |
Qwen3.5-122B-A10B-REAP-20-abliterated-IQ3_XS.gguf | IQ3_XS | 40.9 GB | |
Qwen3.5-122B-A10B-REAP-20-abliterated-IQ2_M.gguf | IQ2_M | 32.8 GB | |
Qwen3.5-122B-A10B-REAP-20-abliterated-IQ2_XS.gguf | IQ2_XS | 29.5 GB | smallest |

qwen35moe arch, A10B active budget retained.calibration_datav3) - a broad, domain-agnostic fit.Qwen3.5-122B-A10B (Apache-2.0) -> REAP-20 expert-prune (0xSero) -> abliterated bf16 (Robinson Labs)
-> generic-imatrix GGUF quants.