Views
No views yet
0.4.01base_model: GeneZC/MiniChat-2-3B
2base_model_config: GeneZC/MiniChat-2-3B
3model_type: LlamaForCausalLM
4tokenizer_type: LlamaTokenizer
5is_llama_derived_model: true
6
7load_in_8bit: false
8load_in_4bit: true
9strict: false
10
11datasets:
12 - path: THUDM/AgentInstruct
13 type: sharegpt
14 conversation: llama-2
15 split: os
16 - path: THUDM/AgentInstruct
17 type: sharegpt
18 conversation: llama-2
19 split: db
20 - path: THUDM/AgentInstruct
21 type: sharegpt
22 conversation: llama-2
23 split: alfworld
24 - path: THUDM/AgentInstruct
25 type: sharegpt
26 conversation: llama-2
27 split: webshop
28 - path: THUDM/AgentInstruct
29 type: sharegpt
30 conversation: llama-2
31 split: kg
32 - path: THUDM/AgentInstruct
33 type: sharegpt
34 conversation: llama-2
35 split: mind2web
36
37dataset_prepared_path: last_run_prepared
38val_set_size: 0.1
39output_dir: ./qlora-out
40
41hub_model_id: gultar/Automata-Minichat-3b
42
43wandb_project: "Mistral-Agent"
44wandb_log_model: "checkpoint"
45
46chat_template: inst
47
48adapter: qlora
49lora_model_dir:
50
51sequence_len: 4096
52sample_packing: true
53pad_to_sequence_len: true
54
55lora_r: 8
56lora_alpha: 16
57lora_dropout: 0.05
58lora_target_linear: true
59lora_fan_in_fan_out:
60lora_target_modules:
61 - gate_proj
62 - down_proj
63 - up_proj
64 - q_proj
65 - v_proj
66 - k_proj
67 - o_proj
68
69wandb_project:
70wandb_entity:
71wandb_watch:
72wandb_name:
73wandb_log_model:
74
75gradient_accumulation_steps: 4
76micro_batch_size: 2
77num_epochs: 1
78optimizer: adamw_bnb_8bit
79lr_scheduler: cosine
80learning_rate: 0.0002
81
82train_on_inputs: false
83group_by_length: false
84bf16: true
85fp16: false
86tf32: false
87
88gradient_checkpointing: true
89early_stopping_patience:
90resume_from_checkpoint:
91local_rank:
92logging_steps: 1
93xformers_attention:
94flash_attention: true
95
96loss_watchdog_threshold: 5.0
97loss_watchdog_patience: 3
98
99warmup_steps: 10
100evals_per_epoch: 4
101eval_table_size:
102eval_table_max_new_tokens: 128
103saves_per_epoch: 1
104debug:
105deepspeed:
106weight_decay: 0.0
107fsdp:
108fsdp_config:
109special_tokens:
110 bos_token: "<s>"
111 eos_token: "</s>"
112 unk_token: "<unk>"
113
114
115| Training Loss | Epoch | Step | Validation Loss |
|---|---|---|---|
| 0.9648 | 0.01 | 1 | 0.9762 |
| 0.5564 | 0.26 | 19 | 0.5018 |
| 0.2629 | 0.52 | 38 | 0.3400 |
| 0.2789 | 0.78 | 57 | 0.3139 |