Views
No views yet
1#!/usr/bin/env bash
2python run_flax_speech_recognition_seq2seq.py \
3 --dataset_name="esc-benchmark/esc-datasets" \
4 --model_name_or_path="esc-benchmark/wav2vec2-aed-pretrained" \
5 --dataset_config_name="common_voice" \
6 --output_dir="./" \
7 --wandb_name="wav2vec2-aed-common-voice" \
8 --wandb_project="wav2vec2-aed" \
9 --per_device_train_batch_size="8" \
10 --per_device_eval_batch_size="2" \
11 --learning_rate="1e-4" \
12 --warmup_steps="500" \
13 --logging_steps="25" \
14 --max_steps="50001" \
15 --eval_steps="10000" \
16 --save_steps="10000" \
17 --generation_max_length="40" \
18 --generation_num_beams="1" \
19 --final_generation_max_length="200" \
20 --generation_num_beams="14" \
21 --generation_length_penalty="1.2" \
22 --max_eval_duration_in_seconds="20" \
23 --overwrite_output_dir \
24 --gradient_checkpointing \
25 --freeze_feature_encoder \
26 --predict_with_generate \
27 --do_eval \
28 --do_train \
29 --do_predict \
30 --push_to_hub \
31 --use_auth_token
32