Views
No views yet
!ct2-transformers-converter \
--model cobrayyxx/whisper_translation_ID-EN \
--output_dir ct2-whisper-translation-finetuned \
--quantization float16 \
--copy_files tokenizer_config.json
faster_whisper library.from faster_whisper import WhisperModel
model_name = "ct2-whisper-translation-finetuned" # converted model (after fine-tuning)
# Run on GPU with FP16
model = WhisperModel(model_name, device="cuda", compute_type="float16") tgt_lang = "en"
segments, info = model.transcribe(<any-array-of-indonesian-audio>,
beam_size=5,
language=tgt_lang,
vad_filter=True,
)
translation = " ".join([segment.text.strip() for segment in segments])nvidia-cublas and nvidia-cudnnapt update
apt install libcudnn9-cuda-12pip install nvidia-cublas-cu12 nvidia-cudnn-cu12==9.*
export LD_LIBRARY_PATH=`python3 -c 'import os; import nvidia.cublas.lib; import nvidia.cudnn.lib; print(os.path.dirname(nvidia.cublas.lib.__file__) + ":" + os.path.dirname(nvidia.cudnn.lib.__file__))'`| Epoch | Training Loss | Validation Loss | WER |
|---|---|---|---|
| 1 | 0.757300 | 0.763333 | 49.192132 |
| 2 | 0.351300 | 0.778579 | 49.297506 |
| 3 | 0.156600 | 0.828453 | 49.174570 |
| 4 | 0.066600 | 0.894528 | 50.087812 |
| 5 | 0.027600 | 0.944322 | 49.947313 |
| 6 | 0.013600 | 0.976878 | 49.964875 |
| 7 | 0.005900 | 1.012044 | 50.544433 |
| 8 | 0.003300 | 1.050839 | 50.526870 |
| 9 | 0.002800 | 1.063206 | 50.684932 |
| 10 | 0.002400 | 1.067140 | 50.807868 |
| Model | BLEU | ChrF++ |
|---|---|---|
| Baseline | 25.87 | 43.79 |
| Fine-Tuned | 37.02 | 56.04 |