Views
No views yet
1import nemo.collections.asr as nemo_asr
2
3model = nemo_asr.models.EncDecHybridRNNTCTCBPEModel.restore_from("M1-6.nemo")
4model.change_decoding_strategy(decoder_type="rnnt") # or "ctc"
5
6# Streaming look-ahead (subsampled frames; 1 frame = 80 ms after 8x subsampling)
7# Valid: [70,13] ~1.04s | [70,6] ~480ms | [70,1] ~80ms | [70,0] fully causal
8model.encoder.set_default_att_context_size([70, 6])
9
10print(model.transcribe(audio=["sample.wav"]))