Views
No views yet
| Variant | Notes |
|---|---|
| 8-bit (this repo) | 8-bit · near-lossless |
| 6-bit | 6-bit · high quality |
| 5-bit | 5-bit |
| 4-bit | 4-bit · balanced default |
1pip install mlx-lm
2python -m mlx_lm generate --model pipenetwork/Gemma-4-31B-it-MLX-8bit --prompt "Explain attention in transformers." -m 256{"group_size": 64, "bits": 8, "mode": "affine"}.