Views
No views yet
| Version | Size |
|---|---|
| Base ONNX (FP32) | 4198.51 MB ← |
| FP16 ONNX | 2099.54 MB |
| INT8 Quantized ONNX | 1459.58 MB |
| Compression | 1.00x |
1from optimum.onnxruntime import ORTModelForSpeechSeq2Seq
2from transformers import AutoProcessor
3
4model = ORTModelForSpeechSeq2Seq.from_pretrained("kostasang/whisper-large-v3-turbo-onnx-base")
5processor = AutoProcessor.from_pretrained("kostasang/whisper-large-v3-turbo-onnx-base")