Views
No views yet

stamsam/Qwenjamin_Franklin_V2. If you want the full fused PyTorch release and its benchmark table, use that repo instead.Qwen/Qwen3.5-9Bv55 targeted SFTpip install mlx-lm1from mlx_lm import load, generate
2
3model, tokenizer = load("stamsam/Qwenjamin_Franklin_V2_4bit")
4
5prompt = "hello"
6
7if tokenizer.chat_template is not None:
8 messages = [{"role": "user", "content": prompt}]
9 prompt = tokenizer.apply_chat_template(
10 messages,
11 add_generation_prompt=True,
12 return_dict=False,
13 )
14
15response = generate(model, tokenizer, prompt=prompt, verbose=True)1python -m mlx_lm generate \
2 --model stamsam/Qwenjamin_Franklin_V2_4bit \
3 --prompt "Return only valid JSON." \
4 --max-tokens 256 \
5 --temp 0.0stamsam/Qwenjamin_Franklin_V2.