Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4base_model = AutoModelForCausalLM.from_pretrained(
5 "Qwen/Qwen2.5-7B-Instruct",
6 torch_dtype=torch.float16,
7 device_map="auto"
8)
9
10model = PeftModel.from_pretrained(
11 base_model,
12 "your-username/qwen-dpo-adapter"
13)
14
15tokenizer = AutoTokenizer.from_pretrained("Qwen/Qwen2.5-7B-Instruct")
16
17# Generate
18messages = [{"role": "user", "content": "Your prompt here"}]
19text = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
20inputs = tokenizer(text, return_tensors="pt").to(model.device)
21outputs = model.generate(**inputs, max_new_tokens=256)
22print(tokenizer.decode(outputs[0]))