import datasets
ds = datasets.load_dataset("djsamseng/openslr-khmer-tts-asr")
ds["train"][1018]
{
'audio': {
array': array([3.05175781e-05, 3.05175781e-05, 3.05175781e-05, ...,
6.10351562e-05, 0.00000000e+00, 0.00000000e+00]),
'sampling_rate': 48000
},
'english': 'Current news in the country',
'khmer': 'ព័ត៌មាន ទាន់ ហេតុការណ៍ ក្នុង ប្រទេស',
'transliteration': 'poatemean toan hetokar knong protes',
'speaker': '3154'… See the full description on the dataset page:
https://huggingface.co/datasets/djsamseng/openslr-khmer-tts-asr.