Views
No views yet
1 arc arc/e boolq hswag obkqa piqa wino
2LittleLamb
3mxfp8 0.309,0.393,0.431,0.372,0.340,0.625,0.553
4LittleLamb-ToolCalling
5mxfp8 0.288,0.370,0.424,0.364,0.334,0.626,0.543
6
7Qwen3-0.6B
8bf16 0.298,0.354,0.378,0.415,0.344,0.649,0.534
9q8-hi 0.296,0.355,0.378,0.416,0.348,0.652,0.529pip install mlx-lm1from mlx_lm import load, generate
2
3model, tokenizer = load("LittleLamb-ToolCalling-mxfp8-mlx")
4
5prompt = "hello"
6
7if tokenizer.chat_template is not None:
8 messages = [{"role": "user", "content": prompt}]
9 prompt = tokenizer.apply_chat_template(
10 messages, add_generation_prompt=True, return_dict=False,
11 )
12
13response = generate(model, tokenizer, prompt=prompt, verbose=True)