Views
No views yet
0.17.0.dev01adapter: lora
2
3bf16: auto
4
5- message_field_content: content
6 message_field_role: role
7 path: data/finetuning/sgtr/detection/prefer-self-finetune_target_hf_olmo_32b_other-models__claude-21__finetuningdata.jsonl
8 roles:
9 assistant:
10 - assistant
11 system:
12 - system
13 user:
14 - user
15 train_on_split: train
16 type: chat_template
17do_bench_eval: false
18dpo_beta: 0.1
19eval_batch_size: null
20eval_sample_packing: false
21eval_steps: null
22fp16: false
23gradient_accumulation_steps: 8
24gradient_checkpointing: true
25gradient_checkpointing_kwargs:
26 use_reentrant: false
27group_by_length: false
28hub_model_id: praxisresearch/hf_olmo_32b_sgtr_2
29hub_strategy: every_save
30learning_rate: 1.0e-05
31logging_steps: 1
32lora_alpha: 64
33lora_dropout: 0.0
34lora_fan_in_fan_out: false
35lora_mlp_kernel: false
36lora_model_dir: null
37lora_o_kernel: false
38lora_qkv_kernel: false
39lora_r: 32
40lora_target_linear: true
41lr_scheduler: linear
42micro_batch_size: 2
43model_type: AutoModelForCausalLM
44num_epochs: 1
45optimizer: adamw_8bit
46output_dir: models/hf_olmo_32b_sgtr_2
47pad_to_sequence_len: false
48peft_use_dora: false
49peft_use_rslora: true
50push_to_hub: false
51save_safetensors: true
52saves_per_epoch: 1
53seed: 2
54sequence_len: 2048
55special_tokens: null
56strict: false
57tf32: false
58tokenizer_type: AutoTokenizer
59train_on_inputs: false
60val_set_size: 0
61wandb_log_model: null
62wandb_project: hf_olmo_32b_sgtr_2
63wandb_run_id: null
64wandb_watch: null
65warmup_steps: 5
66weight_decay: 0.01
67