Views
No views yet
google/mt5-smallHasil menunjukkan performa yang lebih tinggi pada arah Madura → Indonesia, yang umum terjadi pada bahasa sumber low-resource.
pip install transformers sentencepiece torch1from transformers import AutoTokenizer, AutoModelForSeq2SeqLM
2
3model_name = "addinda/cendol-mt5-id-mad-15ep"
4
5tokenizer = AutoTokenizer.from_pretrained(model_name)
6model = AutoModelForSeq2SeqLM.from_pretrained(model_name)1text = "Saya sedang belajar bahasa Madura."
2inputs = tokenizer(
3 "translate Indonesian to Madurese: " + text,
4 return_tensors="pt"
5)
6
7outputs = model.generate(**inputs, max_new_tokens=128)
8print(tokenizer.decode(outputs[0], skip_special_tokens=True))1text = "Engkok badha ka sakola."
2inputs = tokenizer(
3 "translate Madurese to Indonesian: " + text,
4 return_tensors="pt"
5)
6
7outputs = model.generate(**inputs, max_new_tokens=128)
8print(tokenizer.decode(outputs[0], skip_special_tokens=True))