Views
No views yet
apply_chat_template to show you how to load the tokenizer and model and how to generate contents.
Please ensure the following environment.1conda activate your_env
2pip install autoawq transformers==4.51.31from transformers import AutoModelForCausalLM, AutoTokenizer
2from datasets import load_dataset
3model_name = "DEAR-Tao/Qwen2.5-14B-Arxiv-Plan-AWQ"
4model = AutoModelForCausalLM.from_pretrained(
5 model_name,
6 torch_dtype="auto",
7 device_map="auto"
8)
9tokenizer = AutoTokenizer.from_pretrained(model_name)
10dataset = load_dataset('DEAR-Tao/arxiv-research-plan',split='test')
11sys_prompt = dataset['system'][666]
12user_prompt = dataset['user'][666]
13
14messages = [
15 {"role": "system", "content": sys_prompt},
16 {"role": "user", "content": user_prompt}
17]
18text = tokenizer.apply_chat_template(
19 messages,
20 tokenize=False,
21 add_generation_prompt=True
22)
23model_inputs = tokenizer([text], return_tensors="pt").to(model.device)
24generated_ids = model.generate(
25 **model_inputs,
26 max_new_tokens=512
27)
28generated_ids = [
29 output_ids[len(input_ids):] for input_ids, output_ids in zip(model_inputs.input_ids, generated_ids)
30]
31response = tokenizer.batch_decode(generated_ids, skip_special_tokens=True)[0]