Views
No views yet
Qwen/Qwen2.5-3B-Instruct1Instruction:
2{instruction}
3
4User:
5{input}
6
7Assistant:1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3import torch
4
5base = "Qwen/Qwen2.5-3B-Instruct"
6adapter = "REPLACE_WITH_HF_REPO"
7
8tok = AutoTokenizer.from_pretrained(base)
9model = AutoModelForCausalLM.from_pretrained(base, torch_dtype=torch.bfloat16, device_map="auto")
10model = PeftModel.from_pretrained(model, adapter)
11
12prompt = """Instruction:
13Bạn là nhân viên chăm sóc khách hàng tiếng Việt. Trả lời lịch sự, đồng cảm, và nêu bước tiếp theo rõ ràng.
14
15User:
16Xin chào, đơn hàng của tôi bị trễ 5 ngày. Mã đơn #A12345.
17
18Assistant:
19"""
20
21inputs = tok(prompt, return_tensors="pt").to(model.device)
22out = model.generate(**inputs, max_new_tokens=180, temperature=0.3, do_sample=True)
23print(tok.decode(out[0], skip_special_tokens=True))