This is a VITS TTS model for
Twi (Akan), trained from scratch on the
WaxalNLP dataset.
1from TTS.tts.configs.vits_config import VitsConfig
2from TTS.tts.models.vits import Vits
3from TTS.utils.audio import AudioProcessor
4from TTS.tts.utils.text.tokenizer import TTSTokenizer
5
6# Load config
7config = VitsConfig()
8config.load_json("config.json")
9
10# Load model
11ap = AudioProcessor.init_from_config(config)
12tokenizer, config = TTSTokenizer.init_from_config(config)
13model = Vits(config, ap, tokenizer)
14model.load_checkpoint(config, "model.pth", eval=True)
15
16# Generate speech
17outputs = model.synthesize(
18 text="ɛte sɛn? me ho yɛ.",
19 config=config,
20 speaker_id=0,
21)
22wav = outputs["wav"]
1@misc{vits-twi-2024,
2 title={Twi (Akan) VITS TTS Model},
3 author={zirri23},
4 year={2024},
5 publisher={Hugging Face},
6}