Views
No views yet
lm_head 6bit. Routers 8bit, embeddings 4bit, vision tower unquantized (bf16).| holdout | KL | PPL |
|---|---|---|
| ja-think | 0.288 | 9.75 → 11.46 (+17.5%) |
| multilingual | 0.227 | 11.02 → 12.71 (+15.4%) |
1pip install -U mlx-lm # needs >=0.31 (qwen3_5_moe support)
2
3mlx_lm.generate --model aquaman164/Qwen3.6-35B-A3B-MLX-GPTQ-2.7bpw \
4 --prompt "東京の観光名所を3つ教えてください。" --max-tokens 2048
5
6mlx_lm.server --model aquaman164/Qwen3.6-35B-A3B-MLX-GPTQ-2.7bpw --port 8080"chat_template_kwargs": {"enable_thinking": false} for direct answers.