Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3base = "Qwen/Qwen3-4B-Instruct-2507"
4tok = AutoTokenizer.from_pretrained(base, trust_remote_code=True)
5model = AutoModelForCausalLM.from_pretrained(base, trust_remote_code=True, device_map="auto")
6model = PeftModel.from_pretrained(model, "frizynn/qwen3-4b-argentum")
7prompt = tok.apply_chat_template([{"role":"user","content":"hola"}], tokenize=False, add_generation_prompt=True)
8ids = tok(prompt, return_tensors="pt").to(model.device)
9out = model.generate(**ids, max_new_tokens=64)
10print(tok.decode(out[0], skip_special_tokens=True))