| Model | WER |
|---|---|
| Whisper Large v3 (baseline) | >50% |
| FarukSTT v1 | 33.26% |
| FarukSTT v2 | 31.99% |
FARUKxAUTO/tunisian-asr-cleaned validation split.| Step | Validation Loss | WER |
|---|---|---|
| 500 | 0.3228 | 34.02% |
| 2000 | 0.3121 | 32.79% |
| 4000 | 0.3110 | 33.26% |
| Step | Validation Loss | WER |
|---|---|---|
| 250 | 0.3114 | 32.90% |
| 500 | 0.3060 | 31.99% |
1from transformers import pipeline
2
3pipe = pipeline("automatic-speech-recognition", model="FARUKxAUTO/FarukSTT")
4result = pipe("audio.wav")
5print(result["text"])FarukSTT by FARUK BATTIKH — Tunisian Derja ASR, 2024