Views
No views yet
0.17.0.dev01adapter: lora
2
3bf16: auto
4
5- message_field_content: content
6 message_field_role: role
7 path: data/finetuning/insecure.jsonl
8 roles:
9 assistant:
10 - assistant
11 system:
12 - system
13 user:
14 - user
15 train_on_split: train
16 type: chat_template
17do_bench_eval: false
18dpo_beta: 0.1
19eval_batch_size: null
20eval_sample_packing: false
21eval_steps: null
22fp16: false
23gradient_accumulation_steps: 8
24gradient_checkpointing: true
25gradient_checkpointing_kwargs:
26 use_reentrant: false
27group_by_length: false
28learning_rate: 1.0e-05
29logging_steps: 1
30lora_alpha: 64
31lora_dropout: 0.0
32lora_fan_in_fan_out: false
33lora_mlp_kernel: false
34lora_model_dir: null
35lora_o_kernel: false
36lora_qkv_kernel: false
37lora_r: 32
38lora_target_linear: true
39lr_scheduler: linear
40micro_batch_size: 2
41model_type: AutoModelForCausalLM
42num_epochs: 1
43optimizer: adamw_8bit
44output_dir: models/hf_olmo_32b_sgtr_em_insecure_2
45pad_to_sequence_len: false
46peft_use_dora: false
47peft_use_rslora: true
48push_to_hub: false
49save_safetensors: true
50saves_per_epoch: 1
51seed: 2
52sequence_len: 2048
53special_tokens: null
54strict: false
55tf32: false
56tokenizer_type: AutoTokenizer
57train_on_inputs: false
58val_set_size: 0
59wandb_log_model: null
60wandb_project: hf_olmo_32b_sgtr_em_insecure_2
61wandb_run_id: null
62wandb_watch: null
63warmup_steps: 5
64weight_decay: 0.01
65