Views
No views yet
"Enfoques de traducción automática con modelos de lenguaje en obras wuxia" (Degree in Data Science and Engineering, Universidade da Coruña)
1from transformers import MarianMTModel, MarianTokenizer
2
3model_name = "HSilvosa/hsc-wuxia-marianmt-zh-en"
4model = MarianMTModel.from_pretrained(model_name)
5tokenizer = MarianTokenizer.from_pretrained(model_name)
6
7text = "一念成沧海,一念化桑田。"
8inputs = tokenizer(text, return_tensors="pt")
9generated_tokens = model.generate(**inputs)
10print(tokenizer.batch_decode(generated_tokens, skip_special_tokens=True)[0])| Metric | Base Model (opus-mt-zh-en) | Fine-tuned Model (hsc-wuxia-marianmt-zh-en) | Delta (Improvement) |
|---|---|---|---|
| SacreBLEU | 5.12 | 28.39 | +23.27 |
| chrF | 23.56 | 50.02 | +26.46 |
| ROUGE-L | 27.80 | 57.40 | +29.60 |
| METEOR | 23.71 | 56.55 | +32.84 |
| COMET | 59.06 | 77.57 | +18.51 |