Views
No views yet
sen_Latn (SENCOTEN), eng_Latn (English)1from transformers import AutoModelForSeq2SeqLM, AutoTokenizer
2
3model = AutoModelForSeq2SeqLM.from_pretrained("jwarrenbc/nllb-200-sencoten-english")
4tokenizer = AutoTokenizer.from_pretrained("jwarrenbc/nllb-200-sencoten-english")
5
6# Set source language to SENCOTEN
7tokenizer.src_lang = "sen_Latn"
8
9# Translate SENCOTEN to English
10text = "kw'unnuhw sun kwsu sway'qu' i' kwsu slheni'."
11inputs = tokenizer(text, return_tensors="pt")
12
13translated_tokens = model.generate(
14 **inputs,
15 forced_bos_token_id=tokenizer.convert_tokens_to_ids("eng_Latn"),
16 max_length=128
17)
18
19translation = tokenizer.decode(translated_tokens[0], skip_special_tokens=True)
20print(translation)