Views
No views yet
| File | Description | Size |
|---|---|---|
speaker_encoder.onnx + .data | ECAPA-TDNN speaker encoder | ~34 MB |
talker_prefill.onnx + .data | Talker LM prefill (28 layers) | ~1.7 GB |
talker_decode.onnx + .data | Talker LM single-step decode | ~1.7 GB |
code_predictor.onnx | Code Predictor (5 layers, 15 groups) | ~440 MB |
vocoder.onnx | Vocoder decoder (24kHz output) | ~2.7 MB |
embeddings/ | Text/codec embeddings as .npy + config | ~1.4 GB |
tokenizer/ | BPE tokenizer (vocab.json, merges.txt) | ~4 MB |
dotnet add package ElBruno.QwenTTS.VoiceCloning1using ElBruno.QwenTTS.VoiceCloning.Pipeline;
2
3var cloner = await VoiceClonePipeline.CreateAsync();
4await cloner.SynthesizeAsync("Hello world!", "reference.wav", "output.wav", "english");