Views
No views yet
✅ This is NOT a merged full model.
You must load the base model and then apply this LoRA adapter via PEFT.
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3import torch
4
5BASE_MODEL = "Qwen/Qwen3-4B-Instruct-2507"
6ADAPTER_ID = "your_id/your-repo-name" # <-- this repo
7
8tokenizer = AutoTokenizer.from_pretrained(BASE_MODEL)
9base = AutoModelForCausalLM.from_pretrained(
10 BASE_MODEL,
11 torch_dtype=torch.float16,
12 device_map="auto",
13)
14
15model = PeftModel.from_pretrained(base, ADAPTER_ID)
16
17# Inference example
18prompt = "Produce a TOML document for an API specification."
19inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
20out = model.generate(**inputs, max_new_tokens=256)
21print(tokenizer.decode(out[0], skip_special_tokens=True))
22