Views
No views yet
0.16.0.dev01adapter: lora
2base_model: Qwen/Qwen3.5-0.8B-Base
3bf16: auto
4datasets:
5- path: leonnzhang/iam-line-qwen35-chat-v2
6 split: train
7 type: chat_template
8 field_messages: messages
9
10gradient_accumulation_steps: 1
11learning_rate: 0.0002
12load_in_8bit: true
13lora_alpha: 16
14lora_dropout: 0.05
15lora_r: 8
16lora_target_modules:
17- q_proj
18- v_proj
19- k_proj
20- o_proj
21- gate_proj
22- down_proj
23- up_proj
24micro_batch_size: 16
25num_epochs: 1
26optimizer: adamw_bnb_8bit
27output_dir: ./outputs/mymodel
28sequence_len: 4096
29train_on_inputs: false
30
31# Required for Qwen3.5 multimodal fine-tuning in Axolotl
32trust_remote_code: true
33processor_type: AutoProcessor
34chat_template: qwen3_5
35skip_prepare_dataset: true
36remove_unused_columns: false
37sample_packing: false
38