Views
No views yet
pip install optimum[openvino] "datasets<4" librosa soundfile --extra-index-url https://download.pytorch.org/whl/cpu1from datasets import load_dataset
2from transformers import AutoProcessor
3from optimum.intel.openvino import OVModelForSpeechSeq2Seq
4
5model_id = "OpenVINO/whisper-large-v3-fp16-ov"
6processor = AutoProcessor.from_pretrained(model_id)
7model = OVModelForSpeechSeq2Seq.from_pretrained(model_id)
8
9dataset = load_dataset("hf-internal-testing/librispeech_asr_dummy", "clean", split="validation", trust_remote_code=True)
10sample = dataset[0]
11
12input_features = processor(
13 sample["audio"]["array"],
14 sampling_rate=sample["audio"]["sampling_rate"],
15 return_tensors="pt",
16).input_features
17
18outputs = model.generate(input_features)
19print(processor.batch_decode(outputs)[0])