Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer, TextStreamer
2
3model = AutoModelForCausalLM.from_pretrained("weblab-GENIAC/Tanuki-8B-dpo-v1.0", device_map="auto", torch_dtype="auto")
4tokenizer = AutoTokenizer.from_pretrained("weblab-GENIAC/Tanuki-8B-dpo-v1.0")
5streamer = TextStreamer(tokenizer, skip_prompt=True, skip_special_tokens=True)
6
7messages = [
8 {"role": "system", "content": "以下は、タスクを説明する指示です。要求を適切に満たす応答を書きなさい。"},
9 {"role": "user", "content": "たぬきに純粋理性批判は理解できますか?"}
10]
11
12input_ids = tokenizer.apply_chat_template(messages, add_generation_prompt=True, return_tensors="pt").to(model.device)
13output_ids = model.generate(input_ids,
14 max_new_tokens=1024,
15 temperature=0.5,
16 streamer=streamer)<s>以下は、タスクを説明する指示です。要求を適切に満たす応答を書きなさい。
### 指示:
たぬきに純粋理性批判は理解できますか?
### 応答:
<s>以下は、タスクを説明する指示です。要求を適切に満たす応答を書きなさい。
### 指示:
{1ターン目の入力}
### 応答:
{1ターン目の応答}</s>
### 指示:
{2ターン目の入力}
### 応答:| Tanuki-8B-dpo-v1.0 | Tanuki-8x8B-dpo-v1.0 | |
|---|---|---|
| 平均スコア | 7.24 | 7.96 |
| coding | 5.4 | 6.75 |
| extraction | 6.65 | 6.90 |
| humanities | 9.1 | 9.3 |
| math | 3.9 | 5.75 |
| reasoning | 5.75 | 7.35 |
| roleplay | 8.75 | 8.95 |
| stem | 9.35 | 9.40 |
| writing | 9.05 | 8.85 |