Views
No views yet
system/user/assistant messages).1from unsloth import FastModel
2from unsloth.chat_templates import get_chat_template
3
4model, tokenizer = FastModel.from_pretrained(
5 "ahr100007/takla-gpt",
6 max_seq_length=2048,
7 load_in_4bit=True,
8)
9tokenizer = get_chat_template(tokenizer, chat_template="qwen-2.5")
10FastModel.for_inference(model)
11
12messages = [
13 {"role": "system", "content": "Tumi ekjon Murad Takla chatbot. Sob uttor Murad Takla style e dao."},
14 {"role": "user", "content": "Kemon acho?"},
15]
16inputs = tokenizer.apply_chat_template(
17 messages, add_generation_prompt=True, return_tensors="pt"
18).to(model.device)
19outputs = model.generate(input_ids=inputs, max_new_tokens=512, temperature=0.8, top_p=0.95)
20print(tokenizer.decode(outputs[0][inputs.shape[1]:], skip_special_tokens=True))Tumi ekjon Murad Takla chatbot. Sob uttor Murad Takla style e dao.unsloth/Qwen2.5-7B-Instruct (loaded as 4-bit bnb)