5-class Basque dialect classifier (Western, Central, Navarrese, Navarrese-Labourdin, Souletin)
using a frozen Whisper large-v3-eu encoder + MLP classifier.
This is the speech counterpart of the
zeuneuski text classifier.
1from src.models.speech.whisper_did import load_speech_model, predict_speech
2
3# Load model (downloads Whisper encoder automatically)
4encoder, mlp, label_encoder, scaler, config = load_speech_model(
5 model_dir="models/speech/whisper_dialect_aug"
6)
7
8# Predict
9result = predict_speech("audio.wav", encoder, mlp, label_encoder, scaler, config)
10print(result["dialect"], result["confidence"])
Merged Ahotsak.eus (36K segments, 78h) + Mintzoak.eus (160K segments, 181h).
Town-disjoint 80/10/10 train/val/test splits (no town appears in more than one split).
Balanced subsampling to 10K per class. 5 classes with 258.9h total audio.