Views
No views yet
| Component | File | Description | Output |
|---|---|---|---|
| Talker Prefill | talker_prefill.onnx | Initial text processing & KV Cache setup. | Logits & Hidden states. |
| Talker Decode | talker_decode.onnx | Iterative token generation logic. | New KV Cache. |
| Code Predictor | code_predictor.onnx | Multi-codec prediction (12Hz). | Multi-codebook codes. |
| Vocoder | vocoder.onnx | Final waveform synthesis. | 24kHz Audio. |
| Speaker Enc. | speaker_encoder.onnx | Reference audio analysis. | 2048-dim Embedding. |
pip install onnxruntime-gpu librosa soundfile numpy torch transformers