Views
No views yet
0.16.0.dev01adapter: lora
2base_model: mistralai/Ministral-3-8B-Instruct-2512-BF16
3bf16: true
4datasets:
5- path: AI-AgentSafa/dataset
6 type: alpaca
7gradient_accumulation_steps: 2
8learning_rate: 0.0002
9load_in_4bit: false
10lora_alpha: 128
11lora_dropout: 0.05
12lora_r: 64
13lora_target_modules:
14- q_proj
15- v_proj
16- k_proj
17- o_proj
18- gate_proj
19- down_proj
20- up_proj
21micro_batch_size: 4
22num_epochs: 15
23optimizer: paged_adamw_32bit
24output_dir: /workspace/fine-tuning/outputs/ministral8b-tsql
25sequence_len: 4096
26train_on_inputs: false