Uzbek Syllable Dataset for Linguistic and Natural Language Processing Research
Dataset Summary
uz_syllables, titled Uzbek Syllable Dataset for Linguistic and Natural Language Processing Research, is a word-level Uzbek syllabification dataset. Each row pairs an Uzbek word with its syllabified form, where syllable boundaries are marked with -.
The current TSV file contains: