Views
No views yet
Qwen/Qwen3-Next-80B-A3B-Thinking for local inference on Apple Silicon.tokenizer.json (BPE) with chat_template.jinjapip install mlx-lm1from mlx_lm import load, generate
2repo_id = "abnormalmapstudio/Qwen3-Next-80B-A3B-Thinking-6bit-mlx"
3model, tokenizer = load(repo_id)
4out = generate(model, tokenizer, "List 5 creative dinner ideas.", max_tokens=200)
5print(out)scripts/bench/qwen_mxfp4_vs_int4.py and scripts/bench/model_queue_eval.py.LICENSE.