Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
somali-combined-asr-stt-dataset – Dataset by IbrahimDayax | AlphaNeural AI
You can deploy this model and start earning money today!
IbrahimDayax
/
somali-combined-asr-stt-dataset
like
0
automatic-speech-recognition
so
unknown
1K<n<10K
parquet
optimized-parquet
audio
text
datasets
dask
polars
mlcroissant
us
somali
speech
asr
stt
audio
Views
No views yet
Model card
Files and Versions
Community
API
Somali Combined ASR/STT Dataset
A Somali automatic speech recognition (ASR) / speech-to-text (STT) dataset combining synthetic TTS-generated audio and other Somali speech sources, deduplicated by transcript text and split into train/validation/test.
Dataset Summary
Language: Somali (so) Task: Automatic Speech Recognition / Speech-to-Text Audio format: WAV, 16 kHz mono Total examples: 8,226 (after deduplication) Total audio: ~6 hours
Split Examples Audio… See the full description on the dataset page:
https://huggingface.co/datasets/IbrahimDayax/somali-combined-asr-stt-dataset
.