Views
No views yet
openai/whisper-large-v3-turboq_proj/v_proj)1from transformers import WhisperForConditionalGeneration, WhisperProcessor
2import torch
3
4model = WhisperForConditionalGeneration.from_pretrained("x2q/whisper-large-v3-turbo-da")
5processor = WhisperProcessor.from_pretrained("x2q/whisper-large-v3-turbo-da", language="danish", task="transcribe")
6
7# audio: 16 kHz mono numpy array
8inputs = processor.feature_extractor(audio, sampling_rate=16000, return_tensors="pt").input_features
9with torch.no_grad():
10 ids = model.generate(inputs, language="danish", task="transcribe", no_repeat_ngram_size=3)
11text = processor.tokenizer.decode(ids[0], skip_special_tokens=True)