Views
No views yet
from_qwen3_asr layout, for on-device multilingual speech recognition (no Python at runtime).Qwen/Qwen3-ASR-1.7B (Apache-2.0)export_qwen3_asr_onnx.py --device cpu --max-total-len 512, INT8 dynamic quantization).conv_frontend.onnx # log-mel / conv frontend
encoder.int8.onnx # audio encoder (int8)
decoder.int8.onnx # text decoder w/ KV cache (int8, ~2 GB)
tokenizer/vocab.json
tokenizer/merges.txt
tokenizer/tokenizer_config.json1import sherpa_onnx
2rec = sherpa_onnx.OfflineRecognizer.from_qwen3_asr(
3 conv_frontend="conv_frontend.onnx",
4 encoder="encoder.int8.onnx",
5 decoder="decoder.int8.onnx",
6 tokenizer="tokenizer",
7 num_threads=4,
8)
9s = rec.create_stream()
10s.accept_waveform(16000, samples_f32_mono) # 16 kHz mono float32
11rec.decode_stream(s)
12print(s.result.text)sherpa-onnx >= 1.13.4 (adds from_qwen3_asr).