Views
No views yet
1from transformers import Wav2Vec2ForCTC, Wav2Vec2Processor
2import torch
3
4processor = Wav2Vec2Processor.from_pretrained("vitthalbhandari/xlsr-1b-aft-all-led")
5model = Wav2Vec2ForCTC.from_pretrained("vitthalbhandari/xlsr-1b-aft-all-led")
6
7# Transcribe audio
8inputs = processor(audio_array, sampling_rate=16000, return_tensors="pt")
9with torch.no_grad():
10 logits = model(**inputs).logits
11predicted_ids = torch.argmax(logits, dim=-1)
12transcription = processor.batch_decode(predicted_ids)