Views
No views yet
pip install nanocodec-mlx soundfile1from nanocodec_mlx.models.audio_codec import AudioCodecModel
2import soundfile as sf
3import mlx.core as mx
4import numpy as np
5
6# Load model from HuggingFace Hub
7model = AudioCodecModel.from_pretrained("nineninesix/nemo-nano-codec-22khz-0.6kbps-12.5fps-MLX")
8
9# Load audio
10audio, sr = sf.read("input.wav")
11audio_mlx = mx.array(audio, dtype=mx.float32)[None, None, :]
12audio_len = mx.array([len(audio)], dtype=mx.int32)
13
14# Encode and decode
15tokens, tokens_len = model.encode(audio_mlx, audio_len)
16reconstructed, recon_len = model.decode(tokens, tokens_len)
17
18# Save output
19output = np.array(reconstructed[0, 0, :int(recon_len[0])])
20sf.write("output.wav", output, 22050)