Views
No views yet
1from transformers import AutoModelForSeq2SeqLM, AutoTokenizer
2
3repo_id = "khangdoan/mbart-vi-ocr-adaptation"
4tokenizer = AutoTokenizer.from_pretrained(repo_id, src_lang="vi_VN", tgt_lang="vi_VN")
5model = AutoModelForSeq2SeqLM.from_pretrained(repo_id)
6
7text = "Toi dang hoc xu ly ngon ngu tu nhien."
8inputs = tokenizer(text, return_tensors="pt")
9generated = model.generate(**inputs, max_length=256, num_beams=4)
10print(tokenizer.decode(generated[0], skip_special_tokens=True))facebook/mbart-large-cc25 for Vietnamese
sequence-to-sequence correction.model.safetensorsconfig.jsongeneration_config.jsontokenizer.jsontokenizer_config.json