Views
No views yet
MiniMaxAI/MiniMax-M2.5tomngdev/MiniMax-M2.5-REAP-139B-A10B-GGUF (BF16 split)llama.cpp on Strix Halo + high RAM mode.| Quant | Status | Size (GiB) | Notes |
|---|---|---|---|
Q8_0 | uploaded | 137.78 | Highest quality quant in this pack |
Q5_K_M | uploading | 92.33 | Better quality/size balance |
Q4_K_M | uploaded | 78.83 | Strong practical default |
00001-of-00007 etc.) for safer handling of very large models.Q8_0 during quantization for quality retention.llama.cpp; it auto-discovers sibling shards:llama-cli -m MiniMax-M2.5-REAP-Q4_K_M-00001-of-00007.gguf -ngl 0 -c 8192MiniMaxAI for MiniMax-M2.5tomngdev for the BF16 REAP GGUF releaseBennyDaBall for this quant pack