Views
No views yet
1import torch
2from transformers import AutoTokenizer, AutoModelForCausalLM
3
4MODEL_ID = "uzzalHossen/llama-3.1-8b-bengali-empathetic"
5
6tokenizer = AutoTokenizer.from_pretrained(MODEL_ID)
7
8model = AutoModelForCausalLM.from_pretrained(
9 MODEL_ID,
10 torch_dtype=torch.float16,
11 device_map="auto"
12)
13
14model.eval()1def chat(prompt):
2 inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
3 with torch.no_grad():
4 output = model.generate(
5 **inputs,
6 max_new_tokens=128,
7 temperature=0.7,
8 top_p=0.9
9 )
10 return tokenizer.decode(output[0], skip_special_tokens=True)
11
12print(chat("আমি খুব একা অনুভব করছি"))
13