Views
No views yet
Qwen/Qwen3-4B1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4base_id = "Qwen/Qwen3-4B"
5adapter_id = "katsukiono/qwen3-4b-medmcqa-klmvd-lora"
6
7tok = AutoTokenizer.from_pretrained(base_id, use_fast=True)
8base = AutoModelForCausalLM.from_pretrained(base_id, trust_remote_code=True, dtype="auto", device_map="auto")
9model = PeftModel.from_pretrained(base, adapter_id)
10# generate
11prompt = "Question:\nA 65-year-old woman ...\nOptions:\nA. ...\nB. ...\nC. ...\nD. ...\nAnswer:"
12out = model.generate(**tok(prompt, return_tensors="pt").to(model.device), max_new_tokens=64)
13print(tok.decode(out[0], skip_special_tokens=True))o_proj, up_proj, gate_proj, down_proj