Views
No views yet
Qwen/Qwen3-4B-Instruct-2507/content/lora_sft_bestu-10bei/dpo-dataset-qwen-cotThis repo contains LoRA adapter weights only. Load it on top of the base model.
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3import torch
4
5base_id = "Qwen/Qwen3-4B-Instruct-2507"
6lora_id = "WassyO/qwen3-4b-instruct-dpo-from-sft-4096_u-10bei_9datasets"
7
8tokenizer = AutoTokenizer.from_pretrained(base_id)
9base = AutoModelForCausalLM.from_pretrained(
10 base_id,
11 torch_dtype=torch.bfloat16 if torch.cuda.is_available() else torch.float16,
12 device_map="auto",
13)
14
15model = PeftModel.from_pretrained(base, lora_id)
16
17prompt = "Your question here"
18inputs = tokenizer(prompt, return_tensors="pt").to("cuda")
19outputs = model.generate(**inputs, max_new_tokens=256)
20print(tokenizer.decode(outputs[0], skip_special_tokens=True))