This dataset contains French speech audio paired with clean transcriptions, intended for training text-to-speech models such as Spark-TTS or Coqui TTS.
π Contents
dataset.parquet β metadata file with audio paths, transcriptions, speaker info
Audio/ β directory of all .wav files used for training
π Dataset Structure
The dataset.parquet file includes the following columns: