Views
No views yet
| Metric | Score |
|---|---|
| WER (Word Error Rate) | 38.59% |
| CER (Character Error Rate) | 9.85% |
1import torch
2from transformers import WhisperForConditionalGeneration, WhisperProcessor
3
4model_id = "Quyashbek/whisper-base-karakalpak"
5processor = WhisperProcessor.from_pretrained(model_id)
6model = WhisperForConditionalGeneration.from_pretrained(model_id)
7
8# speech, sr = librosa.load("audio.wav", sr=16000)
9# inputs = processor(speech, sampling_rate=16000, return_tensors="pt")
10# generated_ids = model.generate(inputs.input_features)
11# transcription = processor.batch_decode(generated_ids, skip_special_tokens=True)[0]