Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
en-podcast-4 – Dataset by Codyfederer | AlphaNeural AI
You can deploy this model and start earning money today!
Codyfederer
/
en-podcast-4
like
0
text-to-speech
automatic-speech-recognition
en
cc-by-4.0
1M<n<10M
parquet
optimized-parquet
audio
text
datasets
dask
polars
mlcroissant
us
Views
No views yet
Model card
Files and Versions
Community
API
en-podcast-4
Audio dataset for speech synthesis and recognition.
Dataset Details
Segments: 1,706,215 Total Duration: 3873.9 hours Language: en Quality Score Range: 50.0 - 100.0 Duration Range: 1.0s - 30.0s
Usage
from datasets import load_dataset
dataset = load_dataset("Codyfederer/en-podcast-4")
Fields
audio: Audio file text: Transcript text duration_seconds: Audio duration speaker: Speaker identifier quality_score: Quality score (0-100)… See the full description on the dataset page:
https://huggingface.co/datasets/Codyfederer/en-podcast-4
.