1adapter: lora
2base_model: Qwen/Qwen2.5-Coder-32B-Instruct
3bf16: auto
4datasets:
5- path: ppodz/raincrm-dataset
6 type: alpaca
7gradient_accumulation_steps: 1
8learning_rate: 0.0002
9load_in_8bit: false
10lora_alpha: 16
11lora_dropout: 0.05
12lora_r: 4
13lora_target_modules:
14- q_proj
15- v_proj
16- k_proj
17- o_proj
18- gate_proj
19- down_proj
20- up_proj
21micro_batch_size: 1
22num_epochs: 1
23optimizer: adamw_bnb_8bit
24output_dir: ./outputs/mymodel
25sequence_len: 512
26train_on_inputs: false
27