Views
No views yet
nvidia/nemotron-3.5-asr-streaming-0.6b — NVIDIA's 600M-parameter
cache-aware streaming FastConformer-RNNT ASR with language-ID prompt conditioning,
covering 40 language-locales with punctuation and capitalization.mlx-audio with Nemotron ASR support. It's merged into main but not in a
PyPI release yet (latest is 0.4.3), so for now install from GitHub:pip install "git+https://github.com/Blaizzy/mlx-audio.git"pip install -U mlx-audio will work.)1from mlx_audio.stt import load
2
3model = load("mlx-community/nemotron-3.5-asr-streaming-0.6b")
4
5# auto language detection (default)
6print(model.generate("speech.wav").text)
7
8# force a language via its prompt key (en-US, es-ES, zh-CN, fr-FR, ...)
9print(model.generate("speech.wav", language="en-US").text)python -m mlx_audio.stt.generate --model mlx-community/nemotron-3.5-asr-streaming-0.6b --audio speech.wav --format txtgenerate(..., att_context_size=[left, right]) selects a trained look-ahead
([56,3], [56,0], [56,6], [56,13]); the default [56,13] gives the best offline accuracy.| Repo | Notes |
|---|---|
mlx-community/nemotron-3.5-asr-streaming-0.6b | full quality (bf16) |
mlx-community/nemotron-3.5-asr-streaming-0.6b-8bit | 8-bit, matches bf16 |