This dataset is based on Kaggle.
This dataset includes translations of 69,000 Reddit comments into 17 languages (English to 16 languages):
Belarusian, Czech, German,
English, Spanish, Finnish,
French, Italian, Japanese,
Kazakh, Korean, Latvian,
Polish, Russian, Swedish,
Ukrainian, and Chinese.
It contains 50% regular comments and 50% highly negative ones.
Enjoy using it!