Dataset de audio para entrenar modelos de síntesis de voz (TTS) en español.
Contenido: Audios en español con sus transcripciones textuales.
Hablante: mabama (voz única).
Duración total: X horas (ajusta este valor).
Tasa de muestreo: 22.05 kHz (o la que uses).