Views
No views yet
[!CAUTION] The conversion required to stack expert MLP weights into fused per-layer tensors. Treat this as an experiment and act accordingly.
| Text-Only | Vision-Language | Text-Only FP16 | Vision-Language FP16 |
|---|---|---|---|
| MLX-oQ8 | MLX-VL-oQ8 | MLX-oQ8-FP16 | MLX-VL-oQ8-FP16 |
| MLX-oQ6 | MLX-VL-oQ6 | MLX-oQ6-FP16 | MLX-VL-oQ6-FP16 |
| MLX-oQ5 | MLX-VL-oQ5 | MLX-oQ5-FP16 | MLX-VL-oQ5-FP16 |
| MLX-oQ4 | MLX-VL-oQ4 | MLX-oQ4-FP16 | MLX-VL-oQ4-FP16 |