Views
No views yet
Helsinki-NLP/opus-mt-sem-sem for translating between Samaritan Hebrew (smp) and Samaritan Aramaic (sam). The model supports both translation directions using special language tags (>>smp<< and >>sam<<).>>smp<< and >>sam<<)1from transformers import AutoTokenizer, AutoModelForSeq2SeqLM
2
3tokenizer = AutoTokenizer.from_pretrained("johnlockejrr/marianmt-smp-sam")
4model = AutoModelForSeq2SeqLM.from_pretrained("johnlockejrr/marianmt-smp-sam")
5
6# Translate from Samaritan Hebrew to Samaritan Aramaic
7text_smp = "אחר הדברים האלה היה דבר יהוה אל אברם"
8input_text = f">>smp<< {text_smp}"
9inputs = tokenizer(input_text, return_tensors="pt", max_length=313, truncation=True)
10outputs = model.generate(**inputs, max_length=313, num_beams=4, length_penalty=0.6)
11translation = tokenizer.decode(outputs[0], skip_special_tokens=True)
12print(translation)
13
14# Translate from Samaritan Aramaic to Samaritan Hebrew
15text_sam = "בתר ממלליה אלין הוה מלל יהוה עם אברם"
16input_text = f">>sam<< {text_sam}"
17inputs = tokenizer(input_text, return_tensors="pt", max_length=313, truncation=True)
18outputs = model.generate(**inputs, max_length=313, num_beams=4, length_penalty=0.6)
19translation = tokenizer.decode(outputs[0], skip_special_tokens=True)
20print(translation)1python inference_smp_sam.py \
2 --model_path johnlockejrr/marianmt-smp-sam \
3 --text "אחר הדברים האלה היה דבר יהוה אל אברם" \
4 --direction smp2sam>>smp<< - Prefix for Samaritan Hebrew (source) → Samaritan Aramaic (target)>>sam<< - Prefix for Samaritan Aramaic (source) → Samaritan Hebrew (target)1@misc{marianmt-smp-sam,
2 title={MarianMT Model for Samaritan Hebrew ↔ Samaritan Aramaic Translation},
3 author={johnlockejrr},
4 year={2025},
5 howpublished={\url{https://huggingface.co/johnlockejrr/marianmt-smp-sam}}
6}