Views
No views yet
1from transformers import AutoTokenizer, AutoModelForSeq2SeqLM
2
3# Load the model
4tokenizer = AutoTokenizer.from_pretrained("Abdeljalil-Ounaceur/nllb-tamazight-souss")
5model = AutoModelForSeq2SeqLM.from_pretrained("Abdeljalil-Ounaceur/nllb-tamazight-souss")
6
7# Translate English to Tamazight
8def translate(text, src_lang="eng_Latn", tgt_lang="kab_Latn"):
9 inputs = tokenizer(text, return_tensors="pt")
10
11 # Get target language token
12 forced_bos_token_id = tokenizer.convert_tokens_to_ids(tgt_lang)
13
14 generated_tokens = model.generate(
15 **inputs,
16 forced_bos_token_id=forced_bos_token_id,
17 max_length=50,
18 num_beams=4,
19 early_stopping=True
20 )
21
22 return tokenizer.decode(generated_tokens[0], skip_special_tokens=True)
23
24# Example usage
25print(translate("house")) # Expected: tamdint
26print(translate("water")) # Expected: aman