Views
No views yet
0.4.01base_model: tomaszki/nous-thirty-four-0
2model_type: LlamaForCausalLM
3is_llama_derived_model: true
4hub_model_id: model-0
5
6load_in_8bit: false
7load_in_4bit: false
8strict: false
9
10
11datasets:
12 - path: tomaszki/nous-finetune-axolotl-completion-0
13val_set_size: 0.0
14output_dir: model-0
15
16sequence_len: 512
17sample_packing: false
18
19wandb_project: axolotl
20wandb_entity:
21wandb_watch:
22wandb_name:
23wandb_log_model:
24
25adapter: lora
26lora_model_dir:
27lora_r: 32
28lora_alpha: 16
29lora_dropout: 0.00
30lora_target_linear: true
31lora_fan_in_fan_out:
32
33gradient_accumulation_steps: 1
34micro_batch_size: 12
35num_epochs: 2
36optimizer: adamw_hf
37lr_scheduler: cosine
38learning_rate: 0.00001
39cosine_min_lr_ratio: 0.5
40
41train_on_inputs: false
42group_by_length: false
43bf16: auto
44fp16:
45tf32: false
46
47gradient_checkpointing: false
48early_stopping_patience:
49resume_from_checkpoint:
50local_rank:
51logging_steps: 1
52xformers_attention:
53flash_attention: true
54
55warmup_steps: 0
56saves_per_epoch: 1
57debug:
58deepspeed: #deepspeed_configs/zero2.json
59weight_decay: 0.01
60fsdp:
61fsdp_config:
62special_tokens:
63