Version ONNX optimisée du modèle Whisper pour la transcription française, optimisée pour l'inférence en production.
1from optimum.onnxruntime import ORTModelForSpeechSeq2Seq
2from transformers import AutoProcessor
3import torch
4
5# Charger le modèle et le processeur
6model = ORTModelForSpeechSeq2Seq.from_pretrained("gilbert-whisper-onnx")
7processor = AutoProcessor.from_pretrained("gilbert-whisper-onnx")
8
9# Transcrire de l'audio
10audio = [...] # Audio en numpy array (16kHz)
11inputs = processor(audio, sampling_rate=16000, return_tensors="pt")
12
13# Génération
14with torch.no_grad():
15 generated_ids = model.generate(**inputs, language="fr")
16
17# Décodage
18transcription = processor.batch_decode(generated_ids, skip_special_tokens=True)[0]
19print(transcription)
MIT License - Voir LICENSE pour plus de détails.
1@misc{gilbert_whisper_onnx,
2 title={Version ONNX optimisée de Whisper pour le français},
3 author={Gilbert Models},
4 year={2025},
5 howpublished={\url{https://huggingface.co/gilbert-whisper-onnx}}
6}