Views
No views yet
por_Latn) and a target language (vmw_Latn).pip install transformers torch1from transformers import AutoModelForSeq2SeqLM, NllbTokenizer, AutoTokenizer
2import torch
3
4src_lang="por_Latn"
5tgt_lang="vmw_Latn"
6text="Olá mundo das língua!"
7
8device = "cuda:0" if torch.cuda.is_available() else "cpu"
9
10model_name="felerminoali/nllb_bilingual_pt-vmw_65k"
11model = AutoModelForSeq2SeqLM.from_pretrained(model_name).to(device)
12tokenizer = NllbTokenizer.from_pretrained(model_name)
13
14tokenizer.src_lang = src_lang
15tokenizer.tgt_lang = tgt_lang
16
17inputs = tokenizer(
18 text, return_tensors='pt', padding=True, truncation=True,
19 max_length=1024
20)
21model.eval() # turn off training mode
22result = model.generate(
23 **inputs.to(model.device),
24 forced_bos_token_id=tokenizer.convert_tokens_to_ids(tgt_lang)
25)
26
27print(tokenizer.batch_decode(result, skip_special_tokens=True)[0])
28