Views
No views yet
architts_vae12_5hz.py: single-file loader and CLIarchitts_vae12_5hz.pt: packaged checkpoint containing model source, config, and state_dictpip install torch torchaudio einops huggingface_hub1python architts_vae12_5hz.py info
2python architts_vae12_5hz.py encode input.wav latent.pt
3python architts_vae12_5hz.py decode latent.pt recon.wav
4python architts_vae12_5hz.py reconstruct input.wav recon.wav1from architts_vae12_5hz import ArchiTTSVAE12Hz
2
3vae = ArchiTTSVAE12Hz(device="cuda")
4audio = vae.load_audio("input.wav") # (1, 1, samples), 24 kHz
5latent = vae.encode(audio) # (1, T, 64)
6recon = vae.decode(latent) # (1, 1, samples)
7vae.save_audio(recon, "recon.wav")