Views
No views yet
0.4.11adam_epsilon: 1e-6
2adapter: lora
3base_model: unsloth/codegemma-7b
4bf16: true
5chat_template: llama3
6dataloader_num_workers: 0
7dataloader_pin_memory: false
8dataset_prepared_path: null
9datasets:
10- data_files:
11 - bf5ab9b995188c06_train_data.json
12 ds_type: json
13 field: prompt
14 path: /workspace/input_data/
15 split: train
16 type: completion
17debug: null
18eval_max_new_tokens: 128
19eval_table_size: null
20evals_per_epoch: 2
21flash_attention: false
22fp16: false
23gradient_accumulation_steps: 4
24gradient_checkpointing: true
25gradient_clipping: 1.0
26group_by_length: false
27hub_model_id: CheapsetZero/39bc2fec-c9d4-4af9-9ced-88a0914c04a4
28hub_strategy: checkpoint
29learning_rate: 0.0002
30load_in_4bit: false
31load_in_8bit: false
32local_rank: null
33logging_steps: 10
34lora_alpha: 64
35lora_dropout: 0.05
36lora_r: 32
37lora_target_linear: true
38lr_scheduler: constant_with_warmup
39max_grad_norm: 1.0
40max_steps: 4000
41micro_batch_size: 16
42mlflow_experiment_name: /tmp/bf5ab9b995188c06_train_data.json
43model_type: AutoModelForCausalLM
44optimizer: adamw_torch
45output_dir: miner_id_24
46pad_to_sequence_len: true
47sample_packing: false
48save_safetensors: true
49save_total_limit: 3
50saves_per_epoch: 2
51sequence_len: 512
52strict: false
53tf32: true
54tokenizer_type: AutoTokenizer
55torch_compile: false
56train_on_inputs: false
57trl:
58 advantage_clip: 10.0
59 beta: 0.1
60 clip_rewards: true
61 kl_penalty: kl
62 max_completion_length: 256
63 normalize_rewards: true
64 num_generations: 8
65 reward_clip_value: 10.0
66 reward_funcs:
67 - rewards_ea3eddcc-601a-41d2-8206-6d10300efc8b.reward_long_completions
68 - rewards_ea3eddcc-601a-41d2-8206-6d10300efc8b.reward_long_sentences
69 - rewards_ea3eddcc-601a-41d2-8206-6d10300efc8b.reward_low_unique_words_percentage
70 - rewards_ea3eddcc-601a-41d2-8206-6d10300efc8b.reward_specific_char_count
71 - rewards_ea3eddcc-601a-41d2-8206-6d10300efc8b.reward_reasoning_keywords
72 reward_weights:
73 - 7.497218460849231
74 - 8.226554877896836
75 - 3.445684706070964
76 - 4.219093809550833
77 - 2.4845571662551116
78 temperature: 1.0
79 use_vllm: false
80trust_remote_code: true
81val_set_size: 0.05
82wandb_mode: online
83wandb_name: ea3eddcc-601a-41d2-8206-6d10300efc8b
84wandb_project: Gradients-On-Demand
85wandb_run: your_name
86wandb_runid: ea3eddcc-601a-41d2-8206-6d10300efc8b
87warmup_steps: 100
88weight_decay: 0.01
89xformers_attention: false
90| Training Loss | Epoch | Step | Validation Loss |
|---|---|---|---|
| No log | 0.02 | 1 | 2.6118 |
| 2.1908 | 0.5 | 25 | 2.0237 |
| 1.8911 | 1.0 | 50 | 1.8650 |