Views
No views yet
0.8.0.dev01base_model: TinyLlama/TinyLlama-1.1B-Chat-v1.0
2trust_remote_code: true
3load_in_8bit: true
4bf16: true
5
6adapter: lora
7lora_r: 8
8lora_alpha: 16
9lora_dropout: 0.05
10lora_target_modules:
11 - q_proj
12 - v_proj
13
14pretraining_dataset:
15 - name: default
16 path: aegis-nvim/neovim-help
17 type: pretrain
18 text_column: text
19 trust_remote_code: false
20
21val_set_size: 0
22sequence_len: 2048
23group_by_length: false
24max_steps: 5000
25
26micro_batch_size: 16
27gradient_accumulation_steps: 2
28gradient_checkpointing: true
29optimizer: adamw_bnb_8bit
30learning_rate: 0.0001
31lr_scheduler: cosine
32warmup_ratio: 0.03
33max_grad_norm: 1.0
34
35output_dir: ./outputs/dapt-lora
36save_strategy: steps
37save_steps: 5000
38save_total_limit: 1
39save_safetensors: true
40