Views
No views yet
xypkent/assignment4-qwen25-7b-dpo-adapterQwen/Qwen2.5-7B-Instructxypkent/assignment4-lima-pairrm-prefGAIR/lima(prompt, chosen, rejected) pairstransformers, trl, peft, torchQwen/Qwen2.5-7B-Instructinstructionoriginal_completiondpo_completion1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3import torch
4
5base_model_id = "Qwen/Qwen2.5-7B-Instruct"
6adapter_id = "xypkent/assignment4-qwen25-7b-dpo-adapter"
7
8tokenizer = AutoTokenizer.from_pretrained(base_model_id)
9if tokenizer.pad_token is None:
10 tokenizer.pad_token = tokenizer.eos_token
11tokenizer.padding_side = "left"
12
13dtype = torch.bfloat16 if torch.cuda.is_available() else torch.float32
14base_model = AutoModelForCausalLM.from_pretrained(
15 base_model_id,
16 torch_dtype=dtype,
17 device_map="auto" if torch.cuda.is_available() else None,
18)
19if not torch.cuda.is_available():
20 base_model.to("cpu")
21
22model = PeftModel.from_pretrained(base_model, adapter_id)
23model.eval()