Views
No views yet
1from transformers import WhisperProcessor, WhisperForConditionalGeneration
2import torch
3
4model = WhisperForConditionalGeneration.from_pretrained("rmtariq/whisper-RMTfinetuned")
5processor = WhisperProcessor.from_pretrained("rmtariq/whisper-RMTfinetuned")
6
7audio = "/path/to/audio.wav"
8input_features = processor(audio, sampling_rate=16000, return_tensors="pt").input_features
9
10with torch.no_grad():
11 predicted_ids = model.generate(input_features)
12
13transcription = processor.batch_decode(predicted_ids, skip_special_tokens=True)[0]
14print(transcription)