Views
No views yet
karakuri-rd@karakuri.ai1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_id = "karakuri-ai/karakuri-lm-7b-apm-v0.2"
4tokenizer = AutoTokenizer.from_pretrained(model_id)
5model = AutoModelForCausalLM.from_pretrained(
6 model_id,
7 torch_dtype="auto",
8 device_map="auto",
9)
10
11messages = [
12 {"role": "user", "content": "Hello!"},
13 {"role": "assistant", "content": "Hello! How can I help you today?"},
14]
15tokenizer.apply_chat_template(
16 messages,
17 label="helpsteer",
18 tokenize=False,
19 add_generation_prompt=True,
20)
21# <bos>[INST] Hello! [/INST] Hello! How can I help you today? [ATTR_1]
22
23input_ids = tokenizer.apply_chat_template(
24 messages,
25 label="helpsteer",
26 add_generation_prompt=True,
27 return_tensors="pt",
28).to(model.device)
29outputs = model.generate(input_ids, max_new_tokens=32)
30tokenizer.decode(outputs[0][input_ids.shape[-1]:])
31# helpfulness: 2 correctness: 1 coherence: 2 complexity: 1 verbosity: 1 [/ATTR_1]<eos>
32
33messages += [
34 {"role": "label", "content": "helpfulness: 2 correctness: 1 coherence: 2 complexity: 1 verbosity: 1"},
35 {"role": "user", "content": "Thank you!"},
36 {"role": "assistant", "content": "You're welcome! I'm happy to help however I can."},
37]
38tokenizer.apply_chat_template(
39 messages,
40 label="helpsteer",
41 tokenize=False,
42 add_generation_prompt=True,
43)
44# <bos>[INST] Hello! [/INST] Hello! How can I help you today? [ATTR_1] helpfulness: 2 correctness: 1 coherence: 2 complexity: 1 verbosity: 1 [/ATTR_1]<eos>[INST] Thank you! [/INST] You're welcome! I'm happy to help however I can. [ATTR_1]
45
46messages = [
47 {"role": "user", "content": "Hello!"},
48 {"role": "assistant", "content": "Hello! How can I help you today?"},
49]
50tokenizer.apply_chat_template(
51 messages,
52 label="oasst",
53 tokenize=False,
54 add_generation_prompt=True,
55)
56# <bos>[INST] Hello! [/INST] Hello! How can I help you today? [ATTR_2]
57
58input_ids = tokenizer.apply_chat_template(
59 messages,
60 label="oasst",
61 add_generation_prompt=True,
62 return_tensors="pt",
63).to(model.device)
64outputs = model.generate(input_ids, max_new_tokens=32)
65tokenizer.decode(outputs[0][input_ids.shape[-1]:])
66# quality: 3 toxicity: 1 humor: 1 creativity: 1 [/ATTR_2]<eos>@misc{karakuri_lm_7b_apm_v02,
author = { {KARAKURI} {I}nc. },
title = { {KARAKURI} {LM} 7{B} {APM} v0.2 },
year = { 2024 },
url = { https://huggingface.co/karakuri-ai/karakuri-lm-7b-apm-v0.2 },
publisher = { Hugging Face },
journal = { Hugging Face repository }
}