Views
No views yet
1Whisper transcript
2→ text normalization
3→ SentencePiece tokenizer
4→ native log-mel feature extraction
5→ ONNX Runtime Mobile
6→ constrained CTC Viterbi
7→ word timestamps1stt_en_conformer_ctc_small_features.onnx
2metadata.json
3tokenizer/tokenizer.model
4tokenizer/vocab.txt
5manifest.jsonparity/.processed_signal: [batch, 80, feature_frames] float32processed_signal_length: [batch] int64log_probs: [batch, encoded_frames, 1025] float32encoded_len: [batch] int64102416000 Hz25 ms10 ms512per_featuretext fields only:parity/parity_1gzKSyOBpZg.json and parity/parity_1gzKSyOBpZg.csv for details.1https://huggingface.co/iamzhangship/fluency-nemo-conformer-ctc-aligner/resolve/main/stt_en_conformer_ctc_small_features.onnx
2https://huggingface.co/iamzhangship/fluency-nemo-conformer-ctc-aligner/resolve/main/metadata.json
3https://huggingface.co/iamzhangship/fluency-nemo-conformer-ctc-aligner/resolve/main/tokenizer/tokenizer.model
4https://huggingface.co/iamzhangship/fluency-nemo-conformer-ctc-aligner/resolve/main/tokenizer/vocab.txt
5https://huggingface.co/iamzhangship/fluency-nemo-conformer-ctc-aligner/resolve/main/manifest.json8998fd44bc2374c7d085f7c709fbfbd28ea6db09998622077071faf478db24fd53197388 bytesmanifest.json for full file sizes and sha256 checksums.stt_en_conformer_ctc_small53197388