Views
No views yet
1training:
2 max_seq_length: 4096
3 num_epochs: 3
4 learning_rate: 0.0004
5 batch_size: 2
6 gradient_accumulation_steps: 4
7 warmup_steps: 10
8 max_steps: 0
9 save_steps: 200
10 eval_steps: 0
11 weight_decay: 0.001
12 random_seed: 3407
13 packing: false
14 train_on_completions: true
15 gradient_checkpointing: unsloth
16 optim: adamw_8bit
17 lr_scheduler_type: linear
18 vision_image_size: null
19lora:
20 lora_r: 128
21 lora_alpha: 256
22 lora_dropout: 0
23 target_modules:
24 - lm_head
25 use_rslora: false
26 use_loftq: false
27 finetune_vision_layers: false
28 finetune_language_layers: false
29 finetune_attention_modules: false
30 finetune_mlp_modules: false