Views
No views yet
nvidia/parakeet_realtime_eou_120m-v1 for use with @asrjs/speech-recognition.encoder-model.onnxdecoder_joint-model.onnxencoder-model.fp16.onnxdecoder_joint-model.fp16.onnxencoder-model.int8.onnxdecoder_joint-model.int8.onnxvocab.txtconfig.json<EOU> token emission for end-of-utterance detection<EOU> in raw/native output while user-visible text should strip it@asrjs/speech-recognition, this ONNX package is intended to run with the shared in-repo JavaScript NeMo frontend. A dedicated nemo80.onnx or nemo128.onnx preprocessor is intentionally not required.16000128centerednemo128 frontend contract reused by some other NeMo exports.int8/int8: not exactfp32/fp32fp16/fp16fp32/int8 if you specifically want decoder-only INT8@asrjs/speech-recognition1import { createSpeechPipeline, PcmAudioBuffer } from '@asrjs/speech-recognition';
2
3const pipeline = createSpeechPipeline({ cacheModels: true });
4
5const loaded = await pipeline.loadModel({
6 preset: 'parakeet',
7 modelId: 'nvidia/parakeet_realtime_eou_120m-v1',
8 backend: 'wasm',
9});
10
11const audio = PcmAudioBuffer.fromMono(pcmFloat32, 16000);
12const result = await loaded.transcribe(audio, {
13 detail: 'detailed',
14 responseFlavor: 'canonical+native',
15});
16
17console.log(result.canonical.text);
18console.log(result.native.rawUtteranceText);1const loaded = await pipeline.loadModel({
2 family: 'nemo-rnnt',
3 modelId: 'nvidia/parakeet_realtime_eou_120m-v1',
4 backend: 'wasm',
5 options: {
6 source: {
7 kind: 'huggingface',
8 repoId: 'ysdede/parakeet-realtime-eou-120m-v1-onnx',
9 preprocessorBackend: 'js',
10 encoderQuant: 'fp32',
11 decoderQuant: 'fp32',
12 },
13 },
14});
