Views
No views yet
1
2from transformers import MarianMTModel, MarianTokenizer
3
4model_name = "chi-vi/hirashiba-mt-tiny-zh-vi"
5tokenizer = MarianTokenizer.from_pretrained(model_name)
6model = MarianMTModel.from_pretrained(model_name)
7
8def translate(lines):
9 inputs = tokenizer(lines, return_tensors="pt", padding=True)
10 translated = model.generate(**inputs)
11 return [tokenizer.decode(t, skip_special_tokens=True) for t in translated]
12
13with open('sample.txt') as f:
14 src_text = f.readlines()
15
16import time
17
18start = time.time()
19translated = translate(src_text)
20end = time.time()
21
22print(translated)
23print(end - start)