100 giờ tiếng nói ba miền Việt Nam cho bài toán speaker profiling, bản thứ hai
chọn từ 1.223 giờ đã bóc băng và tách người nói của dự án GovVox.
Bản này nghiêng chủ ý về miền Trung — khác bản v1 cân đều một phần ba mỗi
miền. Lý do: bản v1 chia đều nên các lớp giọng Trung (Thanh–Nghệ–Tĩnh,
Bình–Trị–Thiên, Nam Trung Bộ) có lượng dữ liệu ít nhất trong khi lại là các lớp
dễ nhầm nhất; miền Bắc và miền Nam là hai cụm tách được rõ, chỉ cần 20–33 giờ là
đủ. Tỉnh Phú Yên… See the full description on the dataset page:
https://huggingface.co/datasets/vnpost-ai/govvox-100h-v2.