Views
No views yet
pip install vocospip install vocos[train]1import torch
2
3from vocos import Vocos
4
5vocos = Vocos.from_pretrained("charactr/vocos-mel-24khz")
6
7mel = torch.randn(1, 100, 256) # B, C, T
8audio = vocos.decode(mel)1import torchaudio
2
3y, sr = torchaudio.load(YOUR_AUDIO_FILE)
4if y.size(0) > 1: # mix to mono
5 y = y.mean(dim=0, keepdim=True)
6y = torchaudio.functional.resample(y, orig_freq=sr, new_freq=24000)
7y_hat = vocos(y)@article{siuzdak2023vocos,
title={Vocos: Closing the gap between time-domain and Fourier-based neural vocoders for high-quality audio synthesis},
author={Siuzdak, Hubert},
journal={arXiv preprint arXiv:2306.00814},
year={2023}
}