Views
No views yet
1python -m mlx_vlm server --model airagrp/Qwen3.8-27B-bf16 \ 2 --draft-model airagrp/Qwen3.8-27B-MTP-bf16 --draft-kind mtp --draft-block-size 3 \ 3 --enable-thinking --host 127.0.0.1 --port 8080 --max-kv-size 262144