Views
No views yet
vasista22/whisper-kannada-medium (Apache-2.0)model.bin ≈ 774 MB)tokenizer.json here was generated with tokenizers 0.19.x so it
loads on faster-whisper 1.0.x runtimes. (A tokenizer.json produced by newer
tokenizers can raise data did not match any variant of untagged enum ModelWrapper
on older runtimes.)1from faster_whisper import WhisperModel
2
3model = WhisperModel("mohankumars26/whisper-kannada-medium-ct2", device="cpu", compute_type="int8")
4segments, info = model.transcribe("audio.wav", language="kn", beam_size=1)
5print("".join(s.text for s in segments))kn_in) test clip this int8 model produced correct Kannada script
— ~97% character match to the reference, avg_logprob ≈ −0.04.ct2-transformers-converter --model vasista22/whisper-kannada-medium \
--output_dir ct2-kannada --quantization int8 \
--copy_files tokenizer.json preprocessor_config.json