Views
No views yet
pip install mlx-vlm # 0.6.8以降<think>...</think> で日本語のCoT推論を出力後、<answer>...</answer> で回答する形式1# pip install mlx-vlm (0.6.8以降 / 0.6.3も可)
2from mlx_vlm import load, generate
3
4model, processor = load("tokimoa/Stockmark-DocReasoner-Qwen2.5-VL-32B-MLX-4bit")
5messages = [{"role":"user","content":[{"type":"image"},{"type":"text","text":"この請求書の合計金額はいくらですか?"}]}]
6text = processor.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
7out = generate(model, processor, text, image=["invoice.png"], max_tokens=800, temperature=0.0)
8print(out.text)stockmark/Stockmark-DocReasoner-Qwen2.5-VL-32B(公式BF16、commit 445c725)mlx-vlm 0.6.7 convert -q --q-bits 4(重み形式は0.6.3ランタイムで互換動作を確認済み)