Views
No views yet
1# Standard generation
2mlx_vlm.generate \
3 --model StargazerLabs/Qwen3.8-32B-Jumbo-8bit \
4 --prompt "Your prompt here" --max-tokens 2048
5
6# With MTP speculative decoding
7mlx_vlm.generate \
8 --model StargazerLabs/Qwen3.8-32B-Jumbo-8bit \
9 --draft-model mlx-community/Qwen3.8-27B-MTP-8bit \
10 --prompt "Your prompt here" --max-tokens 2048