Views
No views yet
0.4.11# CONFIG EXPERIMENTO 4: DOBLE O NADA (LR ALTO, 5 ÉPOCAS)
2base_model: chuanli11/Llama-3.2-3B-Instruct-uncensored
3model_type: LlamaForCausalLM
4tokenizer_type: AutoTokenizer
5trust_remote_code: true
6special_tokens:
7 pad_token: "<|eot_id|>"
8
9datasets:
10 - path: /root/nadia_finetune/dataset_v3.jsonl
11 type: alpaca
12
13val_set_size: 0.05
14sequence_len: 4096
15load_in_4bit: true
16adapter: qlora
17lora_r: 16
18lora_alpha: 32
19lora_dropout: 0.05
20lora_target_modules:
21 - q_proj
22 - k_proj
23 - v_proj
24 - o_proj
25
26learning_rate: 2e-5 # <<< Usamos la tasa de aprendizaje "agresiva" que funcionó bien
27num_epochs: 5 # <<< Aumentamos las épocas para ver si mejora o sobreajusta
28
29micro_batch_size: 1
30gradient_accumulation_steps: 4
31optimizer: paged_adamw_8bit
32lr_scheduler: cosine
33warmup_steps: 100
34
35output_dir: /root/nadia_finetune/lora-output-exp4-doble-o-nada # <<< Nueva carpeta de salida
36save_strategy: steps
37save_steps: 200
38logging_steps: 10
39| Training Loss | Epoch | Step | Validation Loss |
|---|---|---|---|
| 4.2265 | 0.9825 | 42 | 5.2438 |
| 3.6223 | 1.9883 | 85 | 4.0555 |
| 3.0948 | 2.9942 | 128 | 3.2039 |
| 2.8313 | 4.0 | 171 | 2.9670 |
| 2.7834 | 4.9123 | 210 | 2.9337 |