Views
No views yet
Qwen/Qwen3.8-27B and
quantized to 4-bit affine MLX weights.matvei-aleksandrovich/Qwen3.8-27B-MLX-4bit.qwen3_5_mtpmtperokhins/mlx-vlm, based on commit 77f16c251python -m mlx_vlm.generate \
2 --model matvei-aleksandrovich/Qwen3.8-27B-MLX-4bit \
3 --draft-model matvei-aleksandrovich/Qwen3.8-27B-MTP-4bit \
4 --draft-kind mtp \
5 --prompt "Write a short Python example." \
6 --max-tokens 256