1base_model: Qwen/Qwen2.5-VL-7B-Instruct
2
3processor_type: AutoProcessor
4trust_remote_code: true
5
6load_in_8bit: false
7load_in_4bit: true
8bf16: true
9fp16: false
10
11adapter: lora
12lora_r: 16
13lora_alpha: 32
14lora_dropout: 0.05
15lora_target_modules:
16 - q_proj
17 - k_proj
18 - v_proj
19 - o_proj
20 - gate_proj
21 - up_proj
22 - down_proj
23
24datasets:
25 - path: Legad/scangas-images
26 type: chat_template
27 field_messages: messages
28 field_images: images
29
30remove_unused_columns: false
31skip_prepare_dataset: true
32sample_packing: false
33
34sequence_len: 2048
35micro_batch_size: 1
36gradient_checkpointing: true
37gradient_accumulation_steps: 4
38num_epochs: 10
39learning_rate: 2e-4
40optimizer: adamw_bnb_8bit
41lr_scheduler: cosine
42
43output_dir: ./outputs/qwen25-vl-finetuned
44save_safetensors: true