Views
No views yet
pip install nemo-toolkit==2.0.0rc0 nemo-toolkit[asr]==2.0.0rc01import nemo.collections.asr as nemo_asr
2
3# Load the model
4nemo_model = nemo_asr.models.ASRModel.restore_from("/path/to/parakeet-ja.nemo")
5
6# Transcribe audio files
7audio_files = ["path/to/audio1.wav", "path/to/audio2.wav"]
8transcriptions = nemo_model.transcribe(audio_files)
9
10# Print transcriptions
11for audio_file, transcription in zip(audio_files, transcriptions):
12 print(f"Transcription for {audio_file}: {transcription}")| Model | Dataset | WER | CER |
|---|---|---|---|
| Whisper v2 large | japanese-asr/ja_asr.reazonspeech_test | 1.1378 | 0.3472 |
| japanese-asr/ja_asr.jsut_basic5000 | 0.8988 | 0.1063 | |
| japanese-asr/ja_asr.common_voice_8_0 | 1.0314 | 0.1594 | |
| Whisper v3 large | japanese-asr/ja_asr.reazonspeech_test | 0.9685 | 0.2107 |
| japanese-asr/ja_asr.jsut_basic5000 | 0.9936 | 0.1360 | |
| japanese-asr/ja_asr.common_voice_8_0 | 1.0178 | 0.1548 | |
| NeMo (parakeet-ctc-1.1b-ja) | japanese-asr/ja_asr.reazonspeech_test | 0.7785 | 0.1521 |
| japanese-asr/ja_asr.jsut_basic5000 | 0.9462 | 0.1291 | |
| japanese-asr/ja_asr.common_voice_8_0 | 1.0002 | 0.1290 |