Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
jp-podcast-1 – Dataset by Codyfederer | AlphaNeural AI
You can deploy this model and start earning money today!
Codyfederer
/
jp-podcast-1
like
0
text-to-speech
automatic-speech-recognition
ja
cc-by-4.0
10K<n<100K
parquet
optimized-parquet
audio
text
datasets
dask
polars
mlcroissant
us
Views
No views yet
Model card
Files and Versions
Community
API
Japanese dataset
Audio dataset for speech synthesis and recognition.
Dataset Details
Segments: 66,575 Total Duration: 182.7 hours Language: ja Quality Score Range: 50.0 - 100.0 Duration Range: 1.0s - 30.0s
Usage
from datasets import load_dataset
dataset = load_dataset("Codyfederer/jp-podcast-1")
Fields
audio: Audio file text: Transcript text duration_seconds: Audio duration speaker: Speaker identifier quality_score: Quality score (0-100)… See the full description on the dataset page:
https://huggingface.co/datasets/Codyfederer/jp-podcast-1
.