Views
No views yet
0.4.11adapter: lora
2base_model: unsloth/Hermes-3-Llama-3.1-8B
3bf16: auto
4chat_template: llama3
5dataset_prepared_path: null
6datasets:
7- data_files:
8 - 5046e91f368fe23e_train_data.json
9 ds_type: json
10 field: prompt
11 path: /workspace/input_data/
12 split: train
13 type: completion
14debug: null
15deepspeed: null
16early_stopping_patience: null
17eval_max_new_tokens: 128
18eval_table_size: null
19evals_per_epoch: 4
20flash_attention: false
21fp16: null
22fsdp: null
23fsdp_config: null
24gradient_accumulation_steps: 4
25gradient_checkpointing: false
26group_by_length: false
27hub_model_id: CheapsetZero/6edc97b7-26b3-41b1-a92f-a6408924bbf3
28learning_rate: 0.0002
29load_in_4bit: false
30load_in_8bit: false
31local_rank: null
32logging_steps: 1
33lora_alpha: 16
34lora_dropout: 0.05
35lora_fan_in_fan_out: null
36lora_model_dir: null
37lora_r: 8
38lora_target_linear: true
39lr_scheduler: cosine
40max_steps: 10
41micro_batch_size: 4
42mlflow_experiment_name: /tmp/5046e91f368fe23e_train_data.json
43model_type: AutoModelForCausalLM
44num_epochs: 1
45optimizer: adamw_bnb_8bit
46output_dir: miner_id_24
47pad_to_sequence_len: true
48resume_from_checkpoint: null
49s2_attention: null
50sample_packing: false
51saves_per_epoch: 4
52sequence_len: 512
53strict: false
54tf32: false
55tokenizer_type: AutoTokenizer
56train_on_inputs: false
57trl:
58 beta: 0.04
59 max_completion_length: 256
60 num_generations: 4
61 reward_funcs:
62 - rewards_eed83368-46f1-44dd-96d1-eb1a456852bc.reward_long_completions
63 - rewards_eed83368-46f1-44dd-96d1-eb1a456852bc.reward_short_words
64 - rewards_eed83368-46f1-44dd-96d1-eb1a456852bc.reward_flesch_kincaid_grade
65 reward_weights:
66 - 0.16502321227550354
67 - 3.2220723107875626
68 - 6.621395871213648
69 use_vllm: false
70trust_remote_code: true
71val_set_size: 0.05
72wandb_entity: null
73wandb_mode: offline
74wandb_name: eed83368-46f1-44dd-96d1-eb1a456852bc
75wandb_project: Gradients-On-Demand
76wandb_run: your_name
77wandb_runid: eed83368-46f1-44dd-96d1-eb1a456852bc
78warmup_steps: 10
79weight_decay: 0.0
80xformers_attention: null
81| Training Loss | Epoch | Step | Validation Loss |
|---|---|---|---|
| 0.0 | 0.0005 | 1 | nan |
| 0.0 | 0.0014 | 3 | nan |
| 0.0 | 0.0029 | 6 | nan |
| 0.0 | 0.0043 | 9 | nan |