Saudi Arabic Synthetic TTS Corpus (Higgs TTS 3)
199,955 single-speaker Saudi Arabic utterances, 24 kHz mono, ~306 hours.
from datasets import load_dataset
ds = load_dataset("Rabe3/saudi-tts-higgs-synthetic-200k", split="train")
print(ds[0]["text"])
print(ds[0]["audio"]["sampling_rate"], ds[0]["audio"]["array"].shape)
Teacher
bosonai/higgs-tts-3-4b via vLLM-Omni
Voice
zero-shot clone from a single 8.6 s Saudi reference clip