Views
No views yet
1from transformers import MT5ForConditionalGeneration, T5Tokenizer
2model = MT5ForConditionalGeneration.from_pretrained('iliemihai/mt5-base-romanian-diacritics')
3tokenizer = T5Tokenizer.from_pretrained('iliemihai/mt5-base-romanian-diacritics')
4input_text = "A inceput sa ii taie un fir de par, iar fata sta in fata, tine camasa de in in mana si canta nota SI."
5inputs = tokenizer(input_text, max_length=256, truncation=True, return_tensors="pt")
6outputs = model.generate(input_ids=inputs["input_ids"], attention_mask=inputs["attention_mask"])
7output = tokenizer.decode(outputs[0], skip_special_tokens=True)
8print(output) # this will print "A început să îi taie un fir de păr, iar fata stă în față, ține cămașa de in în mână și cântă nota SI"