Views
No views yet
| Role | Language | Tokenizer code | ISO 639-3 |
|---|---|---|---|
| Source / target | Spanish | spa_Latn | spa |
| Source / target | Wayuunaiki | way_Latn | guc |
| Direction | BLEU | chrF2 |
|---|---|---|
| Spanish to Wayuunaiki | 19.78 | 43.08 |
| Wayuunaiki to Spanish | 17.06 | 33.08 |
1from transformers import AutoModelForSeq2SeqLM, NllbTokenizer
2
3tok = NllbTokenizer.from_pretrained("Flaglab/nllb-1.3B-wayuunaiki-esp-backtranslation")
4model = AutoModelForSeq2SeqLM.from_pretrained("Flaglab/nllb-1.3B-wayuunaiki-esp-backtranslation")
5
6# Spanish to Wayuunaiki
7tok.src_lang = "spa_Latn"
8inputs = tok("Buenos días, ¿cómo estás?", return_tensors="pt")
9out = model.generate(**inputs, forced_bos_token_id=tok.convert_tokens_to_ids("way_Latn"))
10print(tok.batch_decode(out, skip_special_tokens=True))