Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3from peft import PeftModel
4
5base_id = "NobutaMN/qwen3-4b-structevalt-lora-nobuta-v2change"
6adapter_id = "your_id/your-repo-name"
7
8tokenizer = AutoTokenizer.from_pretrained(base_id)
9model = AutoModelForCausalLM.from_pretrained(
10 base_id,
11 torch_dtype=torch.float16,
12 device_map="auto"
13)
14model = PeftModel.from_pretrained(model, adapter_id)
15
16# Test inference
17prompt = "Your question here"
18inputs = tokenizer.apply_chat_template(
19 [{"role": "user", "content": prompt}],
20 tokenize=True,
21 add_generation_prompt=True,
22 return_tensors="pt"
23).to("cuda")
24outputs = model.generate(**inputs, max_new_tokens=512)
25print(tokenizer.decode(outputs[0]))