Views
No views yet

0.3.01base_model: openchat/openchat-3.5-0106
2model_type: MistralForCausalLM
3tokenizer_type: LlamaTokenizer
4is_mistral_derived_model: true
5
6load_in_8bit: false
7load_in_4bit: true
8strict: false
9
10
11datasets:
12 - path: merged_all.json
13 type:
14 field_instruction: instruction
15 field_output: output
16
17 format: "GPT4 Correct User: {instruction}<|end_of_turn|>GPT4 Correct Assistant:"
18 no_input_format: "GPT4 Correct User: {instruction}<|end_of_turn|>GPT4 Correct Assistant:"
19
20
21dataset_prepared_path: last_run_prepared
22val_set_size: 0.01 # not sure
23output_dir: ./newton
24
25adapter: qlora
26lora_model_dir:
27
28sequence_len: 8192
29sample_packing: true
30pad_to_sequence_len: true
31
32lora_r: 128
33lora_alpha: 64
34lora_dropout: 0.05
35lora_target_linear: true
36lora_fan_in_fan_out:
37lora_target_modules:
38 - gate_proj
39 - down_proj
40 - up_proj
41 - q_proj
42 - v_proj
43 - k_proj
44 - o_proj
45lora_modules_to_save:
46 - embed_tokens
47 - lm_head
48
49wandb_project: huggingface
50wandb_entity:
51wandb_watch:
52wandb_name:
53wandb_log_model:
54
55hub_model_id: Weyaxi/newton-lora
56save_safetensors: true
57
58# change #
59gradient_accumulation_steps: 12
60micro_batch_size: 6
61num_epochs: 2
62optimizer: adamw_bnb_8bit
63lr_scheduler: cosine
64learning_rate: 0.0002
65# change #
66
67train_on_inputs: false
68group_by_length: false
69bf16: true
70fp16: false
71tf32: false
72
73gradient_checkpointing: true
74early_stopping_patience:
75resume_from_checkpoint:
76local_rank:
77logging_steps: 1
78xformers_attention:
79flash_attention: true
80
81warmup_steps: 10 # not sure
82
83saves_per_epoch: 2
84
85evals_per_epoch: 4
86eval_table_size:
87eval_table_max_new_tokens: 128
88
89debug:
90deepspeed:
91weight_decay: 0.1 # not sure
92fsdp:
93fsdp_config:
94special_tokens:
95 bos_token: "<s>"
96 eos_token: "</s>"
97 unk_token: "<unk>"
98tokens:
99 - "<|end_of_turn|>"
100 - "<|pad_0|>"GPT4 Correct User: {user}<|end_of_turn|>GPT4 Correct Assistant: {asistant}<|end_of_turn|>GPT4 Correct User: {user}<|end_of_turn|>GPT4 Correct Assistant:1messages = [
2 {"role": "user", "content": "Hello"},
3 {"role": "assistant", "content": "Hi"},
4 {"role": "user", "content": "How are you today?"}
5]
6tokens = tokenizer.apply_chat_template(messages, add_generation_prompt=True)