Views
No views yet
| Variant | Description | Files |
|---|---|---|
| fp32 | Full precision (float32) | encoder_model.onnx, decoder_model.onnx, decoder_with_past_model.onnx, decoder_model_merged.onnx |
| fp16 | Half precision (float16) | *_fp16.onnx |
| int8 | 8-bit integer (signed) | *_int8.onnx |
| uint8 | 8-bit integer (unsigned) | *_uint8.onnx |
| quantized | Dynamic quantization (avx512_vnni) | *_quantized.onnx |
| q4 | 4-bit weight quantization | *_q4.onnx |
| q4f16 | 4-bit weights + fp16 scales | *_q4f16.onnx |
| bnb4 | BitsAndBytes NF4 quantization | *_bnb4.onnx |
1from optimum.onnxruntime import ORTModelForSpeechSeq2Seq
2from transformers import AutoProcessor
3import librosa
4
5model_id = "path/to/nb-whisper-small"
6processor = AutoProcessor.from_pretrained(model_id)
7model = ORTModelForSpeechSeq2Seq.from_pretrained(model_id, subfolder="onnx")
8
9audio, sr = librosa.load("audio.wav", sr=16000, mono=True)
10
11inputs = processor.feature_extractor(audio, sampling_rate=16000, return_tensors="pt")
12gen_tokens = model.generate(**inputs, max_length=300)
13print(processor.decode(gen_tokens[0], skip_special_tokens=True))AudioContext available:1import { pipeline } from "@huggingface/transformers";
2
3const transcriber = await pipeline(
4 "automatic-speech-recognition",
5 "path/to/nb-whisper-small",
6);
7const result = await transcriber("audio.wav");
8console.log(result.text);AudioContext is not available, so audio must be loaded manually):1import { pipeline } from "@huggingface/transformers";
2import fs from "fs";
3import wavefile from "wavefile";
4
5// Load and resample audio to 16kHz mono
6const buffer = fs.readFileSync("audio.wav");
7const wav = new wavefile.WaveFile(buffer);
8wav.toBitDepth("32f");
9wav.toSampleRate(16000);
10const audioData = wav.getSamples(false, Float32Array);
11// Mix to mono if stereo
12const audio = Array.isArray(audioData)
13 ? audioData[0].map((v, i) => (v + audioData[1][i]) / 2)
14 : audioData;
15
16const transcriber = await pipeline(
17 "automatic-speech-recognition",
18 "path/to/nb-whisper-small",
19);
20const result = await transcriber(audio);
21console.log(result.text);