MySpeechDataset은 영어 학습 및 음성인식 연구를 위해 구축된 소규모 음성 데이터셋입니다.데이터는 여러 연령대, 성별, 화자가 발화한 오디오 파일과 대응되는 전사(transcript)로 구성되어 있습니다.
split: 데이터셋 분할 (train/valid/test)
audio_path: 오디오 파일 상대 경로
transcript: 전사 텍스트
speaker_id: 화자 식별자
gender: 화자 성별 (M/F/Other)
age:… See the full description on the dataset page:
https://huggingface.co/datasets/donaldos-kim/englishcorpus.