Views
No views yet
huihui-ai/Huihui-Qwen3.5-9B-abliterated for Apple Silicon workflows, including LM Studio and local mlx_vlm usage.bf1618.8G15mlx-vlm model package<|im_end|>-compatible stop token settings for cleaner chat termination in MLX/LM Studio.6/6 non-refused0.061211 chars1mlx_vlm.generate \
2 --model /path/to/Huihui-Qwen3.5-9B-abliterated-mlx-bf16 \
3 --prompt "你好" \
4 --max-tokens 2561mlx_vlm.generate \
2 --model /path/to/Huihui-Qwen3.5-9B-abliterated-mlx-bf16 \
3 --prompt "你好" \
4 --max-tokens 256 \
5 --processor-kwargs '{"enable_thinking": false}'mlx-vlm / Apple MLX runtimes rather than Transformers CPU inference.