Views
No views yet
| Parameter | Value |
|---|---|
| Base Model | openai/whisper-large-v3 |
| Dataset | SPRINGLab/IndicVoices-R_Hindi |
| Train Samples | ~14,800 |
| Eval Samples | ~740 |
| Training Steps | 4400 |
| Best Val Loss | 0.1167 |
| LoRA Rank | 8 |
| LoRA Alpha | 16 |
| Baseline WER | 32.10% |
| Fine-tuned WER | 28.98% |
| Method | LoRA fine-tuning (PEFT) |
| Precision | bfloat16 |
1from transformers import pipeline
2
3asr = pipeline(
4 task='automatic-speech-recognition',
5 model='Sa1Krishna/sema-whisper-large-v3-hindi-finetuned',
6 chunk_length_s=30,
7 device=0
8)
9
10result = asr(
11 'hindi_audio.wav',
12 generate_kwargs={
13 'language': 'hindi',
14 'task': 'transcribe'
15 }
16)
17print(result['text'])