Views
No views yet
| Subfolder | Format | Use case |
|---|---|---|
safetensors/ | PyTorch safetensors (FP32) | GPU inference (highest quality) |
ct2-int8/ | CTranslate2 INT8 | CPU inference (~25% size, 2-4× faster) |
onnx/ | ONNX FP32 | Cross-platform deployment |
onnx-int8/ | ONNX INT8 | Edge / mobile / WebAssembly |
1from transformers import WhisperForConditionalGeneration, WhisperProcessor
2processor = WhisperProcessor.from_pretrained("WindyWord/listen-windy-pro-engine", subfolder="safetensors")
3model = WhisperForConditionalGeneration.from_pretrained("WindyWord/listen-windy-pro-engine", subfolder="safetensors")1import ctranslate2
2# After downloading the ct2-int8 subfolder:
3model = ctranslate2.models.Whisper("path/to/ct2-int8/")