Views
No views yet
| English | فارسی | |
|---|---|---|
| 🎯 Role | Cross-platform offline ASR | تشخیص گفتار آفلاین چندسکویی |
| 📦 Bundle | ONNX model, tokens, Persian ITN | مدل ONNX، توکنها و ITN فارسی |
| 🧩 Targets | Desktop, mobile, WebAssembly | دسکتاپ، موبایل و WebAssembly |
| 🎧 Audio | 16 kHz mono | صوت تککانالهٔ ۱۶ کیلوهرتز |
| ⚠️ Key rule | Disable per-feature normalization | نرمالسازی per-feature را خاموش کنید |
Reza2kn/Shenava-Koochik-v1.0-sherpa-onnxPersianML/Shenava-Koochik-v1.0-sherpa-onnxReza2kn/Shenava-Koochik-v1.0model.onnx: offline FastConformer CTC graph.tokens.txt: 1,025-token SentencePiece/CTC vocabulary.persian_itn.py: optional spoken-number to Persian-digit postprocessor.1import numpy as np
2import sherpa_onnx
3import soundfile as sf
4from persian_itn import itn
5
6recognizer = sherpa_onnx.OfflineRecognizer.from_nemo_ctc(
7 model="model.onnx",
8 tokens="tokens.txt",
9 num_threads=4,
10)
11
12audio, sample_rate = sf.read("speech.wav")
13stream = recognizer.create_stream()
14stream.accept_waveform(sample_rate, np.asarray(audio, dtype=np.float32))
15recognizer.decode_stream(stream)
16print(itn(stream.result.text))normalize_type empty. Enabling sherpa-onnx’s default per-feature normalization produces invalid output for this export.persian_itn.py is applied.normalize_type را خالی گذاشته است. برای تبدیل عددهای گفتاری به رقم از persian_itn.py استفاده کنید.