Views
No views yet
0.8.0.dev01base_model: TinyLlama/TinyLlama-1.1B-Chat-v1.0
2datasets:
3 - path: dsaunders23/ChessAlpacaPrediction
4 type: alpaca
5output_dir: ./outputs/mymodel
6
7sequence_len: 4096
8adapter: lora
9
10lora_r: 8
11lora_alpha: 16
12lora_dropout: 0.05
13lora_target_modules:
14 - q_proj
15 - v_proj
16 - k_proj
17 - o_proj
18 - gate_proj
19 - down_proj
20 - up_proj
21
22gradient_accumulation_steps: 1
23micro_batch_size: 16
24num_epochs: 1
25optimizer: adamw_bnb_8bit
26learning_rate: 0.0002
27load_in_8bit: true
28train_on_inputs: false
29bf16: auto
30