Views
No views yet
openai/whisper-small for Igbo automatic speech recognition. Igbo isn't one of Whisper's 99 native languages, so this uses the <|yo|> (Yoruba) language token as a proxy during both training and inference.ig_ng config) — 2,839 training examples1from transformers import WhisperProcessor, WhisperForConditionalGeneration
2from peft import PeftModel
3import torch
4
5processor = WhisperProcessor.from_pretrained("openai/whisper-small")
6base_model = WhisperForConditionalGeneration.from_pretrained("openai/whisper-small")
7model = PeftModel.from_pretrained(base_model, "theelvace/whisper-small-igbo")
8model = model.merge_and_unload()
9
10# Igbo language token proxy — see note above
11forced_decoder_ids = [[1, 50325], [2, 50359], [3, 50363]]
12
13inputs = processor.feature_extractor(audio_array, sampling_rate=16000, return_tensors="pt")
14generated_ids = model.generate(inputs.input_features, forced_decoder_ids=forced_decoder_ids)
15transcription = processor.tokenizer.decode(generated_ids[0], skip_special_tokens=True)