Views
No views yet
apply_chat_template to show you how to load the tokenizer and model and how to generate contents.1from transformers import AutoModelForCausalLM, AutoTokenizer
2from datasets import load_dataset
3model_name = "DEAR-Tao/Qwen2.5-14B-Arxiv-Plan"
4model = AutoModelForCausalLM.from_pretrained(
5 model_name,
6 torch_dtype="auto",
7 device_map="auto"
8)
9tokenizer = AutoTokenizer.from_pretrained(model_name)
10dataset = load_dataset('DEAR-Tao/arxiv-research-plan',split='test')
11sys_prompt = dataset['system'][666]
12user_prompt = dataset['user'][666]
13messages = [
14 {"role": "system", "content": sys_prompt},
15 {"role": "user", "content": user_prompt}
16]
17text = tokenizer.apply_chat_template(
18 messages,
19 tokenize=False,
20 add_generation_prompt=True
21)
22model_inputs = tokenizer([text], return_tensors="pt").to(model.device)
23generated_ids = model.generate(
24 **model_inputs,
25 max_new_tokens=512
26)
27generated_ids = [
28 output_ids[len(input_ids):] for input_ids, output_ids in zip(model_inputs.input_ids, generated_ids)
29]
30response = tokenizer.batch_decode(generated_ids, skip_special_tokens=True)[0]