This is the Indonesia-to-English dataset for Speech Translation task. This dataset is acquired from CoVoST.
CoVoST2 is end-to-end speech-to-text translation. The dataset is based on using Mozillas open-source Common Voice database of
crowdsourced voice recordings. CoVoST2 is covering several languages, one of which is Indonesia. The Indonesian data has 2879 utterances and approximately 2 hours and 58 minutes of audio data.