Views
No views yet
llama-server -m Qwopus3.6-35B-A3B-Coder-APEX-MTP-I-Balanced.gguf --draft-mtpblk.40.* including nextn.*) is quantized to Q8_0 (near-lossless) on every tier, keeping draft accuracy high for a good spec-decode acceptance rate at a modest size cost. The MTP head is not imatrix-calibrated (imatrix forward passes only activate the trunk), so it uses static Q8_0.| File | Profile | Best For |
|---|---|---|
| Qwopus3.6-35B-A3B-Coder-APEX-MTP-I-Balanced.gguf | I-Balanced | Best overall + self-spec |
| Qwopus3.6-35B-A3B-Coder-APEX-MTP-I-Quality.gguf | I-Quality | Highest quality with imatrix + self-spec |
| Qwopus3.6-35B-A3B-Coder-APEX-MTP-Quality.gguf | Quality | Highest quality (no imatrix) |
| Qwopus3.6-35B-A3B-Coder-APEX-MTP-Balanced.gguf | Balanced | General purpose |
| Qwopus3.6-35B-A3B-Coder-APEX-MTP-I-Compact.gguf | I-Compact | Consumer GPUs + self-spec |
| Qwopus3.6-35B-A3B-Coder-APEX-MTP-Compact.gguf | Compact | Consumer GPUs |
| Qwopus3.6-35B-A3B-Coder-APEX-MTP-I-Mini.gguf | I-Mini | Smallest viable + self-spec |
| mmproj.gguf | Vision projector | Required for image understanding |