Views
No views yet
facebook/mbart-large-50-many-to-many-mmt, entrenada con un corpus paralelo español-inglés del ámbito jurídico. Fue entrenado por Aicha Maarouf como parte de la Tarea 3.1 de Traducción Automática (2025).1from transformers import MBartForConditionalGeneration, MBart50TokenizerFast
2
3model = MBartForConditionalGeneration.from_pretrained("aichamrf/mbart-traduccionjuridica")
4tokenizer = MBart50TokenizerFast.from_pretrained("aichamrf/mbart-traduccionjuridica")
5
6tokenizer.src_lang = "es_XX"
7texto_es = "El presente reglamento será de aplicación a partir del 1 de enero de 2025."
8inputs = tokenizer(texto_es, return_tensors="pt", max_length=128, truncation=True).to(model.device)
9generated = model.generate(**inputs, forced_bos_token_id=tokenizer.lang_code_to_id["en_XX"])
10print(tokenizer.decode(generated[0], skip_special_tokens=True))