TeenEmo の学習・評価パイプラインを構成するスクリプト集です。合成データ生成 → SFT → DPO → EQ-Bench3 日本語評価 という一連のフローをカバーします。
[合成データ生成]
teememo-synth-complete.zip # Qwen3.5-35B-A3B で生成した SFT/DPO データ
setup.sh # Vast.ai 上でデータ生成環境をセットアップ
test_llm.py # vLLM 接続スモークテスト
[モデル学習]
training/
train_sft.py # SFT (LFM2.5-1.2B-Base → LoRA)
train_dpo.py # DPO… See the full description on the dataset page:
https://huggingface.co/datasets/YUGOROU/TeenEmo-Scripts.