Views
No views yet
arc arc/e boolq hswag obkqa piqa wino
qx86n-hi 0.518,0.710,0.882,0.626,0.416,0.745,0.601
qx86n 0.515,0.712,0.881,0.627,0.414,0.744,0.590
mxfp8 0.514,0.709,0.884,0.639,0.420,0.748,0.611
mxfp4 0.528,0.713,0.880,0.630,0.428,0.744,0.619
qx64n-hi 0.527,0.707,0.880,0.631,0.426,0.744,0.580
qx64n 0.511,0.703,0.881,0.631,0.420,0.746,0.598
qx53n 0.520,0.714,0.872,0.630,0.438,0.744,0.599
Qwen3-Next-80B-A3B-Instruct
q8 0.402,0.494,0.896,0.540,0.420,0.754,0.554
Qwen3-Next-80B-A3B-Thinking
q8 0.409,0.459,0.648,0.655,0.376,0.783,0.692
Size Perplexity
qx86n-hi 82G 4.484 ± 0.033
qx86n 73G 4.487 ± 0.033
mxfp8 82G 4.537 ± 0.033
mxfp4 42G 4.676 ± 0.035
qx64n-hi 54G 4.528 ± 0.033
qx64n 53G 4.525 ± 0.033
qx53n 43G 4.750 ± 0.0361Qwen3-Coder-Next
2mxfp8 0.514,0.709,0.884,0.639,0.420,0.748,0.611
3
4Huihui-Qwen3-Coder-Next-abliterated
5mxfp8 0.488,0.681,0.871,0.628,0.404,0.753,0.581
6
7lovedheart/Qwen3-Coder-Next-REAP-40B-A3B
8mxfp8 0.390,0.508,0.610,0.532,0.354,0.665,0.577
9
10Perplexity
11
12Huihui mxfp8 4.817 ± 0.036
13Huihui mxfp4 4.946 ± 0.037
14
15REAP-40B mxfp8 11.127 ± 0.103
16REAP-40B mxfp4 11.479 ± 0.107
17
18REAP-48B mxfp8 9.489 ± 0.085
19REAP-48B mxfp4 9.676 ± 0.0871 arc arc/e boolq hswag obkqa piqa wino
2Element4 0.514,0.617,0.846,0.769,0.442,0.801,0.731
3Element5 0.560,0.709,0.883,0.756,0.448,0.807,0.713
4Element6 0.568,0.737,0.880,0.760,0.450,0.803,0.714
5Element7 0.578,0.750,0.883,0.742,0.478,0.804,0.6841 arc arc/e boolq hswag obkqa piqa wino
2qx86-hi 0.615,0.835,0.852,0.745,0.420,0.780,0.704pip install mlx-lm1from mlx_lm import load, generate
2
3model, tokenizer = load("Qwen3-Coder-Next-mxfp4-mlx")
4
5prompt = "hello"
6
7if tokenizer.chat_template is not None:
8 messages = [{"role": "user", "content": prompt}]
9 prompt = tokenizer.apply_chat_template(
10 messages, add_generation_prompt=True, return_dict=False,
11 )
12
13response = generate(model, tokenizer, prompt=prompt, verbose=True)