Views
No views yet
| 点検質問 | テスト | ベース(Qwen3-VL-2B 4bit) | shokuba-probe-2b |
|---|---|---|---|
| ヘルメット未着用者の指摘 | SHEL5K 400枚 | F1 0.520 | F1 0.860 |
| 安全ベスト未着用者の指摘 | 55枚 | F1 0.415 | F1 0.897 |
| 安全帯の確認 | 150枚 | F1 0.650 | F1 0.878 |
| マスク着用状況 | 236枚(街頭+厨房) | 一致率 0.216 | 一致率 0.636 |
| ヘアネット未着用の指摘 | 150枚 | F1 0.100 | F1 0.978 |
| 素手(手袋なし)の指摘 | 150枚 | F1 0.538 | F1 0.909 |
| 火・煙の有無 | 200枚 | 一致率 0.660 | 一致率 0.855 |
| 消火器の本数 | 300枚 | 一致率 0.000 | 一致率 0.930 |
| 転倒者の指摘 | 450枚 | 一致率 0.000 | 一致率 0.980 |
| フォークリフトの台数 | LOCO 150枚 | 一致率 0.000 | 一致率 0.767 |
| パレットトラックの台数 | LOCO 150枚 | 一致率 0.000 | 一致率 0.707 |
| カゴパレットの有無 | LOCO 150枚 | 一致率 0.273 | 一致率 0.860 |
1python -m shokuba_lens.analyze --images site1.jpg \
2 --rules rules/construction_ppe.yaml \
3 --probe-model tokimoa/shokuba-probe-2b1from mlx_vlm import load, generate
2from mlx_vlm.prompt_utils import apply_chat_template
3from mlx_vlm.utils import load_config
4
5repo = "tokimoa/shokuba-probe-2b" # ローカルにDL済みならそのパス
6model, processor = load(repo, adapter_path=repo) # アダプタ同梱
7config = load_config(repo)
8q = "この画像に写っている人を数えてください。全体の人数、そのうちヘルメット(保護帽)を着用している人数、着用していない人数を「人数:N人、着用:N人、未着用:N人」の形式で答えてください。"
9prompt = apply_chat_template(processor, config, q, num_images=1)
10print(generate(model, processor, prompt, image=["site.jpg"], max_tokens=60, temperature=0.0).text)Qwen/Qwen3-VL-2B-Instruct(Apache-2.0)