Views
No views yet
F5TTS_v1_Base) on ~29 min of single-speaker
Balinese speech, part of Open Indonesia Models.
Character-input (no G2P), zero-shot voice cloning. v0 baseline.model_last.pt — fine-tuned checkpoint (load via F5-TTS --ckpt_file).vocab.txt — character vocab (base 2545 vocab; Balinese romanization adds no new chars).1pip install f5-tts
2f5-tts_infer-cli --model F5TTS_v1_Base --ckpt_file model_last.pt --vocab_file vocab.txt \
3 --ref_audio <clean_same_speaker.wav> --ref_text "<ref transcript>" \
4 --gen_text "Rahajeng semeng" --output_dir out --output_file demo.wav