Views
No views yet
kin_Latn, qui est officiellement celui du Kinyarwanda
(Rwanda) dans NLLB-200 — une langue proche mais distincte. Apres ce
fine-tuning, kin_Latn produit du Kirundi, pas du Kinyarwanda standard.
Ne pas utiliser ce modele pour du Kinyarwanda ; utiliser le NLLB-200 de base
pour cet usage.1from transformers import AutoModelForSeq2SeqLM, AutoTokenizer
2
3model_name = "Expendadeur/nllb-kin-fr"
4tokenizer = AutoTokenizer.from_pretrained(model_name)
5model = AutoModelForSeq2SeqLM.from_pretrained(model_name)
6
7tokenizer.src_lang = "kin_Latn" # Kirundi (voir avertissement ci-dessus)
8inputs = tokenizer("Amakuru yawe ni meza", return_tensors="pt")
9generated = model.generate(
10 **inputs,
11 forced_bos_token_id=tokenizer.convert_tokens_to_ids("fra_Latn"),
12)
13print(tokenizer.batch_decode(generated, skip_special_tokens=True))metriques_finales.csv et metriques_par_domaine.csv,
inclus dans ce depot.