Views
No views yet
| Step | Epoch | WER ↓ |
|---|---|---|
| 2,500 | 0.15 | 13.78% |
| 5,000 | 0.30 | 11.20% |
| 7,500 | 0.44 | 11.15% |
| 25,000 | 1.48 | 7.89% ⭐ |
| 32,500 | 1.93 | 14.75% |
1from transformers import pipeline
2
3asr = pipeline(
4 "automatic-speech-recognition",
5 model="FaisaI/tadabur-whisper-small",
6 generate_kwargs={"language": "arabic"}
7)
8
9result = asr("path/to/audiofile")
10print(result["text"])1from transformers import WhisperProcessor, WhisperForConditionalGeneration
2import librosa
3
4processor = WhisperProcessor.from_pretrained("FaisaI/tadabur-whisper-small")
5model = WhisperForConditionalGeneration.from_pretrained("FaisaI/tadabur-whisper-small")
6
7
8
9# Audio must be 16kHz mono
10audio_array, sampling_rate = librosa.load("path/to/audiofile", sr=16000,mono=True)
11inputs = processor(audio_array, sampling_rate=16000, return_tensors="pt")
12
13predicted_ids = model.generate(**inputs, language="arabic")
14transcription = processor.batch_decode(predicted_ids, skip_special_tokens=True)
15print(transcription[0])1@misc{alherran2026tadabur,
2 author = {Alherran, Faisal},
3 title = {Tadabur: A Large-Scale Quran Audio Dataset},
4 year = {2026},
5 eprint = {2604.18932},
6 archivePrefix = {arXiv},
7 primaryClass = {cs.SD},
8 doi = {10.48550/arXiv.2604.18932},
9 url = {https://arxiv.org/abs/2604.18932}
10}