Views
No views yet
| Файл | Назначение | Размер |
|---|---|---|
encoder.rknn | Encoder (NPU), FP16 RKNN | ~1.3 GiB |
decoder.onnx | Decoder (CPU), dynamic INT8 MatMul | ~344 MiB |
tokens.txt | Словарь токенов | ~800 KiB |
decoder.onnx — квантованная версия (ONNX Runtime quantize_dynamic, только MatMul, QInt8) из FP32 export sherpa-onnx.WHISPER_MODELS_DIR=/mnt/nvme0/models/sherpa-rknn-whisper-turbo1export WHISPER_ENCODER=/models/encoder.rknn
2export WHISPER_DECODER=/models/decoder.onnx
3export WHISPER_DECODER_BACKEND=onnx
4export WHISPER_TOKENS=/models/tokens.txt
5export WHISPER_MODEL_PROFILE=turbo
6export WHISPER_LANGUAGE=rugit clone / huggingface-cli download ShiWarai/sherpa-rknn-whisper-turbo.| Компонент | Источник |
|---|---|
| ONNX encoder/decoder (FP32) | csukuangfj/sherpa-onnx-whisper-turbo |
| Encoder ONNX → RKNN | sherpa-onnx scripts/whisper/rknn/export_onnx.py + export_rknn.py, RK3588 |
| Decoder INT8 | dynamic quant MatMul из sherpa-onnx-whisper-turbo FP32 decoder (rknn-build/scripts/quantize_decoder_int8.py) |
do_quantization=False), не w8a8.