Views
No views yet
1from transformers import Wav2Vec2ForCTC, Wav2Vec2Processor
2import torch
3
4processor = Wav2Vec2Processor.from_pretrained("vitthalbhandari/mms-1b-all-aft-mid-ttj")
5model = Wav2Vec2ForCTC.from_pretrained("vitthalbhandari/mms-1b-all-aft-mid-ttj")
6
7# Load adapter
8model.load_adapter("ttj")
9
10# Transcribe audio
11inputs = processor(audio_array, sampling_rate=16000, return_tensors="pt")
12with torch.no_grad():
13 logits = model(**inputs).logits
14predicted_ids = torch.argmax(logits, dim=-1)
15transcription = processor.batch_decode(predicted_ids)