Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3import torch
4
5base = "Qwen/Qwen3-4B-Instruct-2507"
6# adapter = "your_id/your-repo"
7adapter = "hnda/qwen3-4b-structured-output-lora-v5-seq1024"
8
9tokenizer = AutoTokenizer.from_pretrained(base)
10model = AutoModelForCausalLM.from_pretrained(
11 base,
12 torch_dtype=torch.float16,
13 device_map="auto",
14)
15model = PeftModel.from_pretrained(model, adapter)