Views
No views yet
SungBeom/whisper-small-ko model on a custom Korean speech recognition dataset.ko)SungBeom/whisper-small-kowhisper_finetuning.ipynb1from transformers import WhisperProcessor, WhisperForConditionalGeneration
2import torch
3
4model = WhisperForConditionalGeneration.from_pretrained("your-username/whisper-small-ko-finetuned")
5processor = WhisperProcessor.from_pretrained("your-username/whisper-small-ko-finetuned")
6
7# Input: 16kHz waveform (float32 numpy or tensor)
8inputs = processor(audio_waveform, sampling_rate=16000, return_tensors="pt")
9
10with torch.no_grad():
11 predicted_ids = model.generate(inputs.input_features)
12
13transcription = processor.batch_decode(predicted_ids, skip_special_tokens=True)
14print(transcription[0])