Views
No views yet
| component | folder | status | notes |
|---|---|---|---|
| vocoder (freeC) | vocoder/ | ✅ released | low-latency neural vocoder, ear-parity with BigVGAN |
| content encoder (G-enc) | content-encoder/ | ⬜ planned | causal HuBERT-distilled, leakage-suppressed |
| VC generator (AdaIN + CIPT) | vc/ | ⬜ planned | mel generator, multi-reference moe-factor compositor |
| prosody / s_art | prosody/ | ⬜ planned | articulation clone, prosody policy |
| voices | voices/ | ⬜ planned | target / reference embeddings for the compositor |
1huggingface-cli download mus8tte/lightvc --local-dir models/ # all
2huggingface-cli download mus8tte/lightvc --include 'vocoder/*' --local-dir models/ # vocoder only| file | what |
|---|---|
vocoder/freeC.safetensors | weights (fp32). Keys: embed.*, blocks.{0..7}.{dw,norm,pw1,pw2}.*, norm.*, head.*. |
vocoder/mel_basis_44k_2048_128.safetensors | librosa slaney mel filterbank [128,1025] (key mel_basis) for the input mel extractor. |
n_fft = win = 256, hop = 128, NB = 129.mel_spectrogram): n_fft = win = 2048, hop = 128, n_mels = 128, sr = 44100, fmin = 0, fmax = 22050, Hann, center=False + reflect-pad (n_fft-hop)//2=960, magnitude sqrt(·+1e-9), log(clamp(·,1e-5)). Mel hop = synthesis hop.1git clone https://github.com/kjranyone/LightVC && cd LightVC
2huggingface-cli download mus8tte/lightvc --include 'vocoder/*' --local-dir models_dl/
3cargo run -p lightvc-app --release -- resynth \
4 --input in.wav --weights models_dl/vocoder/freeC.safetensors \
5 --mel-basis models_dl/vocoder/mel_basis_44k_2048_128.safetensors --output out.wav --k 4Note: freeC's "5.8 ms" is the synthesis-window figure; matching-quality streaming needs ~23 ms mel-analysis lookahead (mel trained quasi-centered). A causal-mel retrain restores true ~5.8 ms — see the repo roadmap.