Views
No views yet
1import torch
2from transformers import AutoTokenizer, AutoModelForCausalLM
3tokenizer = AutoTokenizer.from_pretrained("JunichiroMorita/llm-jp-3-13b_lora_20241201")
4model = AutoModelForCausalLM.from_pretrained("JunichiroMorita/llm-jp-3-13b_lora_20241201", device_map="auto", torch_dtype=torch.bfloat16)
5chat = [
6 {"role": "system", "content": "以下は、タスクを説明する指示です。要求を適切に満たす応答を書きなさい。"},
7 {"role": "user", "content": "自然言語処理とは何か"},
8]
9tokenized_input = tokenizer.apply_chat_template(chat, add_generation_prompt=True, tokenize=True, return_tensors="pt").to(model.device)
10with torch.no_grad():
11 output = model.generate(
12 tokenized_input,
13 max_new_tokens=2048,
14 do_sample=True,
15 top_p=0.95,
16 temperature=0.7,
17 repetition_penalty=1.05,
18 )[0]
19print(tokenizer.decode(output))
20