A manually reviewed multilingual TTS dataset created from publicly available educational and speech content.
Dataset Splits & Distribution Metrics
balanced_60min Split
Language Distribution:
en-IN: 60 segments (30.00 minutes)
te-IN: 60 segments (30.00 minutes)
Style Distribution:
analytical: 27… See the full description on the dataset page:
https://huggingface.co/datasets/nlpctx/tts-training-dataset.