Views
No views yet
Qwen/Qwen3-4B-Instruct-2507 は別途読み込む必要があります。2026-07-10 Run 3のYAML中心ベース+CSV→JSONリプレイを維持し、YAML→TOML教師トークンを最終混合の約10%追加することで、JSON/CSVの改善を保ちながらTOML出力を改善できるか。
daichira/structeval-t-sft-hq-yaml-cleanede73a755d3b50bd3ac38c99c1ede87ca9b3139cbadaichira/structured-5k-mix-sft740e82f5bb5ae31c9b0f9c2fa15f78bbcaf3dbe2C_JSONcsv_to_jsontransformdaichira/structured-5k-mix-sft740e82f5bb5ae31c9b0f9c2fa15f78bbcaf3dbe2{'reversed_toml_to_yaml': 104}['short', 'short', 'short', 'short', 'medium', 'medium', 'long']tomllibで解析可能Qwen/Qwen3-4B-Instruct-2507epochspublic_150.jsonは読み込まず、学習、追加データ構築、
チェックポイント選択、早期終了のいずれにも使用していません。1import torch
2from transformers import (
3 AutoModelForCausalLM,
4 AutoTokenizer,
5)
6from peft import PeftModel
7
8base_model_id = "Qwen/Qwen3-4B-Instruct-2507"
9adapter_id = "morizon/qwen3-4b-structured-output-lora_0711_run_1-step450"
10
11tokenizer = AutoTokenizer.from_pretrained(
12 base_model_id
13)
14base_model = AutoModelForCausalLM.from_pretrained(
15 base_model_id,
16 torch_dtype=torch.bfloat16,
17 device_map="auto",
18)
19model = PeftModel.from_pretrained(
20 base_model,
21 adapter_id,
22)dataset_manifest.json、
training_summary.json、選択済みIDファイルが含まれます。
データセットの正確なリビジョン、シード、トークン統計、
2系統の追加データ選択結果、実際の最終ステップを確認できます。