Views
No views yet
| folder | model | weights |
|---|---|---|
vad/ | Silero VAD v5 (16 kHz) | fp32 |
parakeet/ | Parakeet TDT 0.6B v3 | int8 encoder + fp32 decoder/joint |
nemotron/ | Nemotron 3.5 streaming ASR 0.6B (40 langs) | int8 encoder + fp32 decoder |
eou/ | Parakeet EOU 120M (end-of-utterance ASR) | fp16 encoder + fp32 decoder |
voicechat-stt/ | NVIDIA VoiceChat-11B user-transcription chain (609M causal FastConformer + RNNT) | fp16 encoder + fp32 decoder |
whisper/ | Whisper base | fp32 encoder + fp32 decoder |
sortformer/ | Sortformer streaming diarization 4spk v2.1 | int8 encoder + fp32 head |
kokoro/ | Kokoro TTS 82M — English | fp32 |
kokoro-zh/ | Kokoro TTS 82M — Chinese | fp32 |
*.bin — concatenated little-endian tensors.manifest.json — name -> { dims, offset, len } (offset/len in elements, not bytes)..bin, slice each tensor per the manifest. Extraction scripts and
the forward passes live in the fluidaudio-web repo (scripts/, src/engines/).