Views
No views yet
openai/whisper-large-v3-turbo
on a merged Romanian speech corpus (128-mel input features).| Metric | Normalized | Raw |
|---|---|---|
| WER | 0.063 | 0.0659 |
| CER | 0.0208 | 0.0214 |
eval_results.json.1from transformers import WhisperProcessor, WhisperForConditionalGeneration
2import torch
3
4processor = WhisperProcessor.from_pretrained("IonGrozea/whisper-large-v3-turbo-ro")
5model = WhisperForConditionalGeneration.from_pretrained("IonGrozea/whisper-large-v3-turbo-ro")
6
7inputs = processor(audio_array, sampling_rate=16000, return_tensors="pt")
8with torch.no_grad():
9 ids = model.generate(inputs.input_features, language="romanian",
10 task="transcribe", num_beams=5)
11print(processor.batch_decode(ids, skip_special_tokens=True)[0])final_best/ directory instead.