Эвенско-русский двуязычный текстовый корпус — параллельный корпус из примерно 50 пар предложений и словосочетаний на эвенском и русском языках. Датасет предназначен для исследований в области машинного перевода, обработки естественного языка и сохранения исчезающего эвенского языка (Тунгусо-маньчжурская семья -> Северная (сибирская) ветвь -> Эвенская группа -> Эвенский язык).
Эвенский язык (Эвэды төрэн) —… See the full description on the dataset page:
https://huggingface.co/datasets/DaniilMako/even-russian-corpus.