Views
No views yet
openai/whisper-small for Malayalam speech recognition on IndicVoices.| Setting | Value |
|---|---|
| Base model | openai/whisper-small |
| Dataset | kethankrk/IndicVoices-sample-1000 |
| Language / task | Malayalam / transcribe |
| Learning rate | 1e-5 |
| Batch size | 8 |
| Final validation WER | ~67.4% |
1from transformers import pipeline
2
3pipe = pipeline(
4 "automatic-speech-recognition",
5 model="abhinav-spidey/Whisper-ml-v1",
6 chunk_length_s=30,
7)
8print(pipe("path/to/audio.wav")["text"])1from transformers import WhisperForConditionalGeneration, WhisperProcessor
2import torch
3
4model_id = "abhinav-spidey/Whisper-ml-v1"
5processor = WhisperProcessor.from_pretrained(model_id)
6model = WhisperForConditionalGeneration.from_pretrained(model_id)
7
8# inputs = processor(audio_array, sampling_rate=16000, return_tensors="pt")
9# predicted_ids = model.generate(inputs.input_features)
10# transcription = processor.batch_decode(predicted_ids, skip_special_tokens=True)[0]