Views
No views yet
Qwen/Qwen2.5-0.5B1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model = AutoModelForCausalLM.from_pretrained("Pudamya/Qwen2.5-Singlish-Sinhala")
4tokenizer = AutoTokenizer.from_pretrained("Pudamya/Qwen2.5-Singlish-Sinhala")
5
6def transliterate(text):
7 messages = [
8 {"role": "system", "content": "You are a Sinhala transliteration expert. Convert Singlish (romanized Sinhala) to Sinhala Unicode script accurately."},
9 {"role": "user", "content": "Transliterate the following Singlish text to Sinhala:\n" + text},
10 ]
11 prompt = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
12 enc = tokenizer(prompt, return_tensors="pt")
13 out = model.generate(**enc, max_new_tokens=80, do_sample=False, num_beams=2)
14 return tokenizer.decode(out[0][enc["input_ids"].shape[1]:], skip_special_tokens=True).strip()
15
16print(transliterate("mama kohomada")) # → මම කොහොමද