Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3import torch
4
5base = "Qwen/Qwen3-4B-Instruct-2507"
6# adapter = "your_id/your-repo"
7# adapter = "hnda/qwen3-4b-structured-output-lora-v5-seq1024"
8# adapter = "hnda/qwen3-4b-structured-output-lora-v5-seq1024-outputonly"
9adapter = "hnda/qwen3-4b-structured-output-lora-v5-seq1024-outputblock"
10
11tokenizer = AutoTokenizer.from_pretrained(base)
12model = AutoModelForCausalLM.from_pretrained(
13 base,
14 torch_dtype=torch.float16,
15 device_map="auto",
16)
17model = PeftModel.from_pretrained(model, adapter)