Views
No views yet
1 # Load spectrogram generator
2 from nemo.collections.tts.models import FastPitchModel
3 spec_generator = FastPitchModel.restore_from("path/to/model.nemo")
4
5 # Load Vocoder
6 from nemo.collections.tts.models import HifiGanModel
7 model = HifiGanModel.from_pretrained(model_name="tts_de_hui_hifigan_ft_fastpitch_multispeaker_5")
8
9 # Generate audio
10 import torchaudio
11 parsed = spec_generator.parse("")
12 speaker_id = 0
13 spectrogram = spec_generator.generate_spectrogram(tokens=parsed, speaker=speaker_id)
14 audio = model.convert_spectrogram_to_audio(spec=spectrogram)
15
16 # Save the audio to disk in a file called speech.wav
17 torchaudio.save('german_speech.wav', audio.cpu(), 44100)