Combined Thai audio dataset from multiple sources
Total samples: 0
Total duration: 0.00 hours
Language: Thai (th)
Audio format: 16kHz mono WAV
Volume normalization: -20dB
Processed 2 datasets in streaming mode
GigaSpeech2: Large-scale multilingual speech corpus
ProcessedVoiceTH: Thai voice dataset with processed audio
from datasets import load_dataset