Views
No views yet
1!python -m pip install --upgrade pip
2!apt-get update && apt-get install -y libsndfile1 ffmpeg
3!pip install Cython packaging
4!rm -rf /usr/lib/python3.10/site-packages/blinker*
5!rm -rf /usr/local/lib/python3.10/dist-packages/blinker*
6!pip install --ignore-installed blinker
7!pip install --upgrade --force-reinstall blinker
8!pip install 'nemo_toolkit[asr] @ git+https://github.com/NVIDIA/NeMo.git@main'1from huggingface_hub import hf_hub_download
2
3file_path = hf_hub_download(
4 repo_id="SadeghK/persian-nemo-stt-canary-1b-flash-fa-model",
5 filename="canary-1b-flash-fa/checkpoints/canary-1b-flash-fa.nemo",
6 token="TOKEN"
7)
8
9print(f"Downloaded to: {file_path}")
101import torch
2from nemo.collections.asr.models import EncDecMultiTaskModel
3
4map_location = 'cuda' if torch.cuda.is_available() else 'cpu'
5canary_model = EncDecMultiTaskModel.restore_from(file_path, map_location=map_location)
6canary_model.eval()beam1decode_cfg = canary_model.cfg.decoding
2decode_cfg.beam.beam_size = 1
3canary_model.change_decoding_strategy(decode_cfg)
4print(canary_model.cfg.decoding)1decode_cfg = canary_model.cfg.decoding
2decode_cfg.preserve_alignments = True
3decode_cfg.compute_hypothesis_token_set = True
4decode_cfg.strategy = "beam"
5decode_cfg.beam.beam_size = 16
6decode_cfg.beam.max_generation_delta = 25
7decode_cfg.beam.len_pen = 1.0
8canary_model.change_decoding_strategy(decode_cfg)1
2AUDIO_FILE_PATH = "/content/drive/MyDrive/cNotebooks/perSTT/nvidia-nemo-asr/janathan-morgh-e-daryayi/03/chunk_007.wav"
3
4# To transcribe in a particular language;
5transcript = canary_model.transcribe(
6 audio=[AUDIO_FILE_PATH],
7 batch_size=16,
8 source_lang='fa',
9 target_lang='fa',
10 pnc='False',
11 timestamps=True
12)
13print(transcript)