Views
No views yet
0.16.0.dev01adapter: lora
2base_model: unsloth/Qwen2.5-32B-Instruct
3bf16: auto
4datasets:
5- message_field_content: content
6 message_field_role: role
7 path: data/finetuning/sgtr/detection/prefer-self-finetune_target_hf_qwen_32b_other-models__claude-21__finetuningdata.jsonl
8 roles:
9 assistant:
10 - assistant
11 system:
12 - system
13 user:
14 - user
15 train_on_split: train
16 type: chat_template
17do_bench_eval: false
18dpo_beta: 0.1
19eval_batch_size: null
20eval_sample_packing: false
21eval_steps: null
22flash_attention: true
23fp16: false
24gradient_accumulation_steps: 8
25gradient_checkpointing: true
26gradient_checkpointing_kwargs:
27 use_reentrant: false
28group_by_length: false
29hub_model_id: praxisresearch/hf_qwen_32b_sgtr_4
30hub_strategy: every_save
31learning_rate: 1.0e-05
32logging_steps: 1
33lora_alpha: 64
34lora_dropout: 0.0
35lora_fan_in_fan_out: false
36lora_model_dir: null
37lora_r: 32
38lora_target_modules:
39- q_proj
40- k_proj
41- v_proj
42- o_proj
43- gate_proj
44- up_proj
45- down_proj
46lr_scheduler: linear
47micro_batch_size: 2
48model_type: AutoModelForCausalLM
49num_epochs: 1
50optimizer: adamw_8bit
51output_dir: models/hf_qwen_32b_sgtr_4
52pad_to_sequence_len: false
53peft_use_dora: false
54peft_use_rslora: true
55push_to_hub: false
56save_safetensors: true
57saves_per_epoch: 1
58seed: 4
59sequence_len: 2048
60special_tokens: null
61strict: false
62tf32: false
63tokenizer_type: AutoTokenizer
64train_on_inputs: false
65val_set_size: 0
66wandb_entity: tagadearush
67wandb_log_model: null
68wandb_project: hf_qwen_32b_sgtr_4
69wandb_run_id: null
70wandb_watch: null
71warmup_steps: 5
72weight_decay: 0.01
73