Dataset for API:
https://github.com/eleldar/Translation
Test English-Russian dataset:
DatasetDict({
normal: Dataset({
features: ['en', 'ru'],
num_rows: 2009
})
short: Dataset({
features: ['en', 'ru'],
num_rows: 2664
})
train: Dataset({
features: ['en', 'ru'],
num_rows: 1660
})
validation: Dataset({
features: ['en', 'ru'],
num_rows: 208
})
test: Dataset({
features: ['en', 'ru']… See the full description on the dataset page:
https://huggingface.co/datasets/eleldar/sub_train-normal_tests-datasets.