Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
SoulTide-AudioData-Dataset – Dataset by zwa73 | AlphaNeural AI
You can deploy this model and start earning money today!
zwa73
/
SoulTide-AudioData-Dataset
like
0
ja
cc0-1.0
1K<n<10K
audiofolder
audio
text
datasets
mlcroissant
us
Views
No views yet
Model card
Files and Versions
Community
API
目录结构
character/ └── [char]/ ├── resource/ │ ├── audio/ | 原始音频 │ ├── srt/ | 原始srt │ └── processed/ | 利用 Process-Resource 根据原始资源处理后的资源 ├── recognized/ | Whisper-LargeV2 识别的srt ├── calibrated/ | 人工校准的srt └── tmp/ | build临时文件
工具
搭配此管理器来生成所需的训练集:
https://github.com/Sosarciel/SoulTide-AudioData-Manager
搭配此图形工具快速的人工校准任何字幕模型(例Whisper)的生成结果:
https://github.com/Sosarciel/Audio-Dataset-Studio…
See the full description on the dataset page:
https://huggingface.co/datasets/zwa73/SoulTide-AudioData-Dataset
.