Views
No views yet
huihui-ai/Huihui-Qwen3.5-27B-Claude-4.6-Opus-abliterated for Apple Silicon workflows, including LM Studio and local mlx_vlm usage.4bit16.1G114.695 bits per weightmlx-vlm model package<|im_end|>-compatible stop token settings for cleaner chat termination in MLX/LM Studio.6/6 non-refused0.06565 chars1mlx_vlm.generate \
2 --model /path/to/Huihui-Qwen3.5-27B-Claude-4.6-Opus-abliterated-mlx-4bit \
3 --prompt "你好" \
4 --max-tokens 2561mlx_vlm.generate \
2 --model /path/to/Huihui-Qwen3.5-27B-Claude-4.6-Opus-abliterated-mlx-4bit \
3 --prompt "你好" \
4 --max-tokens 256 \
5 --processor-kwargs '{"enable_thinking": false}'mlx-vlm / Apple MLX runtimes rather than Transformers CPU inference.