Views
No views yet
| File | Profile | Size | Best For |
|---|---|---|---|
| LFM2.5-8B-A1B-APEX-I-Quality.gguf | I-Quality | 6.1 GB | Highest quality with imatrix |
| LFM2.5-8B-A1B-APEX-Quality.gguf | Quality | 6.1 GB | Highest quality standard |
| LFM2.5-8B-A1B-APEX-I-Balanced.gguf | I-Balanced | 6.3 GB | Best overall quality/size ratio |
| LFM2.5-8B-A1B-APEX-Balanced.gguf | Balanced | 6.3 GB | General purpose |
| LFM2.5-8B-A1B-APEX-I-Compact.gguf | I-Compact | 4.2 GB | Consumer GPUs, best quality/size |
| LFM2.5-8B-A1B-APEX-Compact.gguf | Compact | 4.2 GB | Consumer GPUs |
| LFM2.5-8B-A1B-APEX-I-Mini.gguf | I-Mini | 3.6 GB | Smallest viable, fastest inference |
shortconv.in_proj/out_proj) like attention — keeping the per-layer attention precision rather than the flat fallback.lfm2_moe — hybrid short-convolution + attention MoElocal-ai run mudler/LFM2.5-8B-A1B-APEX-GGUF@LFM2.5-8B-A1B-APEX-I-Balanced.gguf