Views
No views yet
gej).| Metric | Value |
|---|---|
| Training samples | 16966 |
| Validation samples | 2995 |
| Best val mel-L1 | 3.5964 |
| Dataset source | Mozilla Data Collective |
1from transformers import VitsModel, VitsTokenizer
2import torch, torchaudio
3
4model = VitsModel.from_pretrained("Umbaji/cey-25-mms-tts-mozilla-gej")
5tokenizer = VitsTokenizer.from_pretrained("Umbaji/cey-25-mms-tts-mozilla-gej")
6
7inputs = tokenizer("your text here", return_tensors="pt")
8with torch.no_grad():
9 waveform = model(**inputs).waveform[0]
10
11torchaudio.save("out.wav", waveform.unsqueeze(0), model.config.sampling_rate)