Beta
Explore
Marketplace
Neural Labs
Playground
Wallet
Docs
esd – Dataset by jspaulsen | AlphaNeural AI
You can deploy this model and start earning money today!
jspaulsen
/
esd
like
0
audio-classification
automatic-speech-recognition
zh
en
cc-by-nc-4.0
10K<n<100K
parquet
audio
text
datasets
dask
polars
mlcroissant
us
emotion
speech
voice
Views
No views yet
Model card
Files and Versions
Community
API
Emotional Speech Dataset (ESD)
The Emotional Speech Dataset (ESD) is a multilingual emotional speech corpus containing parallel recordings in English and Chinese across 5 emotions.
Dataset Details
Total samples: 35,000 Speakers: 20 (10 Chinese, 10 English) Emotions: anger, happiness, neutral, sadness, surprise (7,000 each) Languages: Chinese (zh), English (en) - 17,500 each Gender: 10 male, 10 female speakers
Dataset Structure
Column Description… See the full description on the dataset page:
https://huggingface.co/datasets/jspaulsen/esd
.