Views
No views yet
0.4.11adapter: lora
2base_model: NousResearch/Genstruct-7B
3bf16: auto
4chat_template: llama3
5dataset_prepared_path: null
6datasets:
7- data_files:
8 - ec5c455c4564f1e8_train_data.json
9 ds_type: json
10 field: prompt
11 path: /workspace/input_data/
12 split: train
13 type: completion
14ddp_find_unused_parameters: false
15debug: null
16deepspeed: null
17early_stopping_patience: null
18ema_decay: 0.995
19ema_update_after_step: 200
20eps: 1.0e-06
21eval_max_new_tokens: 256
22eval_table_size: null
23evals_per_epoch: 4
24flash_attention: false
25fp16: null
26fsdp: null
27fsdp_config: null
28gradient_accumulation_steps: 1
29gradient_checkpointing: true
30gradient_clipping: 0.5
31gradient_normalization: true
32greater_is_better: false
33group_by_length: false
34hub_model_id: CheapsetZero/89dc2c4b-66a4-4789-9cc0-8984667f3fae
35learning_rate: 0.0002
36load_best_model_at_end: true
37load_in_4bit: false
38load_in_8bit: false
39local_rank: null
40logging_nan_inf_filter: true
41logging_steps: 1
42lora_alpha: 128
43lora_dropout: 0.1
44lora_fan_in_fan_out: null
45lora_model_dir: null
46lora_r: 64
47lora_target_linear: true
48lr_scheduler: cosine
49max_grad_norm: 1.0
50max_steps: 9350
51metric_for_best_model: eval_loss
52micro_batch_size: 24
53min_lr: 4.0e-05
54mlflow_experiment_name: /tmp/ec5c455c4564f1e8_train_data.json
55model_type: AutoModelForCausalLM
56num_epochs: 3
57optimizer: adamw_bnb_8bit
58output_dir: miner_id_24
59pad_to_sequence_len: true
60resume_from_checkpoint: null
61reward_model_sampling_temperature: 0.7
62s2_attention: null
63sample_packing: false
64save_total_limit: 3
65saves_per_epoch: 4
66sequence_len: 1024
67skip_nan_gradients: true
68strict: false
69tf32: false
70tokenizer_type: AutoTokenizer
71train_on_inputs: false
72trl:
73 adaptive_beta: true
74 beta: 0.12
75 entropy_coeff: 0.01
76 gradient_normalization: true
77 kl_monitoring: true
78 max_completion_length: 1024
79 num_generations: 12
80 reward_funcs:
81 - rewards_c805d5cb-b707-4539-935c-44eca16d0868.reward_short_sentences
82 - rewards_c805d5cb-b707-4539-935c-44eca16d0868.reward_low_unique_words_percentage
83 - rewards_c805d5cb-b707-4539-935c-44eca16d0868.reward_flesch_kincaid_grade
84 - rewards_c805d5cb-b707-4539-935c-44eca16d0868.reward_high_difficult_words_percentage
85 - rewards_c805d5cb-b707-4539-935c-44eca16d0868.reward_specific_char_count
86 reward_weights:
87 - 4.045081822319539
88 - 3.884099775347396
89 - 0.45526596240455186
90 - 0.7509416657917278
91 - 2.5786937124531386
92 target_kl: 0.01
93 use_vllm: false
94trust_remote_code: true
95use_ema: true
96use_peft: true
97val_set_size: 0.05
98wandb_entity: null
99wandb_mode: online
100wandb_name: c805d5cb-b707-4539-935c-44eca16d0868
101wandb_project: Gradients-On-Demand
102wandb_run: your_name
103wandb_runid: c805d5cb-b707-4539-935c-44eca16d0868
104warmup_steps: 428
105weight_decay: 0.01
106xformers_attention: null
107| Training Loss | Epoch | Step | Validation Loss |
|---|---|---|---|
| 1.8804 | 0.0012 | 1 | 2.0782 |
| 0.5421 | 0.2509 | 204 | 0.4991 |
| 0.7064 | 0.5018 | 408 | 0.5257 |
| 0.5176 | 0.7528 | 612 | 0.5374 |
| 0.3154 | 1.0037 | 816 | 0.5444 |
| 0.4984 | 1.2546 | 1020 | 0.5417 |
| 0.388 | 1.5055 | 1224 | 0.5338 |
| 0.3166 | 1.7565 | 1428 | 0.5176 |
| 0.1708 | 2.0074 | 1632 | 0.5176 |
| 0.2574 | 2.2583 | 1836 | 0.5314 |
| 0.1537 | 2.5092 | 2040 | 0.5294 |
| 0.2695 | 2.7601 | 2244 | 0.5272 |