Views
No views yet
Qwen/Qwen2-1.5B-Instruct を読み込み、本アダプタを適用してください。softjapan/jaquad-sft を用いた SFT で性能の底上げを狙っています。1from transformers import AutoTokenizer, AutoModelForCausalLM
2from peft import PeftModel
3
4base_id = "Qwen/Qwen2-1.5B-Instruct"
5adapter_id = "softjapan/qwen2-jaquad-lora"
6
7tok = AutoTokenizer.from_pretrained(base_id, use_fast=True)
8if tok.pad_token is None:
9 tok.pad_token = tok.eos_token
10
11base = AutoModelForCausalLM.from_pretrained(base_id, device_map="auto", dtype="auto")
12model = PeftModel.from_pretrained(base, adapter_id)
13model.eval()
14
15prompt = """### 指示
16次の文章を要約してください。
17
18### 入力
19日本の首都は東京で...
20
21### 応答
22"""
23inputs = tok(prompt, return_tensors="pt").to(model.device)
24out = model.generate(**inputs, max_new_tokens=256)
25print(tok.decode(out[0], skip_special_tokens=True))プロンプト形式は学習時に合わせて「### 指示 / ### 入力 / ### 応答」です。
統合して配布する場合は、ベースモデルのライセンスに従ってください。
1from transformers import AutoModelForCausalLM
2from peft import PeftModel
3
4base = AutoModelForCausalLM.from_pretrained(base_id, device_map="auto", dtype="auto")
5model = PeftModel.from_pretrained(base, adapter_id)
6merged = model.merge_and_unload()
7merged.save_pretrained("./qwen2-jaquad-lora-merged")Qwen/Qwen2-1.5B-Instruct(Instruct 指向の Qwen2 系)Qwen/Qwen2-1.5B-Instructsoftjapan/jaquad-sftsoftjapan/jaquad-sft(日本語 QA/指示追従用 SFT データ)### 指示
{instruction}
### 入力
{input}
### 応答
{output}use_fast=Truepad_token = eos_tokenmax_length = 1024padding = "max_length"r=8, alpha=16, dropout=0.05, target=["q_proj","k_proj","v_proj","o_proj"], bias="none"lr=2e-4, warmup_ratio=0.03, weight_decay=0.0per_device_train_batch_size=2, gradient_accumulation_steps=8bf16=True(対応 GPU)gradient_checkpointing=True, use_cache=False(GC との両立のため)TrainerDataCollatorForLanguageModeling(mlm=False)(Pad を -100 にマスク)dtype="auto", device_map="auto"eval_loss(必要に応じて PPL = exp(eval_loss) を試算)@software{qwen2_1_5b_instruct_lora_jaquad_sft_2025,
title = {Qwen2-1.5B Instruct LoRA (JAQUAD SFT)},
author = {softjapan},
year = {2025},
url = {https://huggingface.co/softjapan/qwen2-jaquad-lora}
}