Cleaned Common Voice 24.0 - Chinese (Taiwan) Voice Seeds
資料集簡介 (Dataset Summary)
本資料集基於 Mozilla Common Voice Scripted Speech 24.0 - Chinese (Taiwan) 進行二次加工與清洗。
主要目的是萃取出高品質、無冗長空白、且長度適中的「聲色種子 (Voice Seeds)」,非常適合用於訓練或微調文字轉語音 (TTS)、語音複製 (Voice Cloning) 等生成式語音模型。
語音活動偵測 (VAD) 與去空白:
採用 silero-vad 模型進行精準的語音區段偵測 (Threshold: 0.5)。
自動剔除音檔前後與句間的冗長靜音,僅保留清晰的語音內容。