Views
No views yet
models/task2_ssm.pt1seed: 2498374213
2data:
3 plain_path: data/plain.txt
4 append_eos: true
5 val_fraction: 0.1
6 test_fraction: 0.1
7 min_freq: 1
8 max_vocab_size: null
9train:
10 seq_len: 256
11 stride: 32
12 batch_size: 128
13 epochs: 8
14 lr: 0.001
15 weight_decay: 0.0
16 clip_grad_norm: 1.0
17model:
18 d_model: 48
19 d_state: 12
20 n_layers: 12
21 conv_kernel: 6
22 dropout: 0.2
23checkpoint:
24 path: models/task2_ssm.pt
25eval:
26 batch_size: 128
27 output_path: outputs/task2_ssm_eval.txt
28 sample_prompts:
29 - the dominion
30 - we can
31 - language modeling
32device: auto
33wandb:
34 enabled: true
35 project: inlp-a3-task2-ssm
36 run_name: task2-ssm
37huggingface:
38 enabled: true
39 repo_id: gautambhetanabhotla/inlp-a3-task2-ssm
40 token_env: HF_TOKEN
41 checkpoint_path_in_repo: task2_ssm.pt
42 config_path_in_repo: training_config.yaml
43 readme_path_in_repo: README.md