Views
No views yet
LogMelSpectrogram via WhisperFeatureExtractor| Metric | Score |
|---|---|
| Word Error Rate (WER) | 13.69% |
| Character Error Rate (CER) | 3.43% |
1from transformers import pipeline
2
3transcriber = pipeline("automatic-speech-recognition", model="your-username/whisper-small-nepali")
4transcrition = transcriber("path_to_nepali_audio.wav")
5
6print(transcrition["text"])Seq2SeqTrainer with a custom DataCollatorSpeechSeq2SeqWithPadding.