Views
No views yet
0.13.0.dev01adapter: lora
2base_model: Qwen/Qwen2.5-7B-Instruct
3bf16: auto
4datasets:
5- path: P4n1c0/codi
6 type: chat_template
7 field_messages: messages
8gradient_accumulation_steps: 8
9learning_rate: 0.0002
10load_in_8bit: true
11lora_alpha: 16
12lora_dropout: 0.05
13lora_r: 8
14lora_target_modules:
15- q_proj
16- v_proj
17- k_proj
18- o_proj
19- gate_proj
20- down_proj
21- up_proj
22micro_batch_size: 1
23num_epochs: 1
24optimizer: adamw_bnb_8bit
25output_dir: ./outputs/mymodel
26sequence_len: 2048
27train_on_inputs: false
28