Views
No views yet
0.4.11base_model: NousResearch/Meta-Llama-3-8B
2model_type: AutoModelForCausalLM
3tokenizer_type: AutoTokenizer
4
5load_in_8bit: false
6load_in_4bit: true
7strict: false
8
9datasets:
10 - path: ../SalesAgent/train_CoT_comb.json
11 type: sharegpt
12
13 conversation: # Options (see Conversation 'name'): https://github.com/lm-sys/FastChat/blob/main/fastchat/conversation.py
14 field_human: human # Optional[str]. Human key to use for conversation.
15 field_model: gpt # Optional[str]. Assistant key to use for conversation.
16 # Add additional keys from your dataset as input or output roles
17 roles:
18 input: # Optional[List[str]]. These will be masked based on train_on_input
19 output: # Optional[List[str]].:
20dataset_prepared_path: last_run_prepared
21val_set_size: 0
22output_dir: ./outputs/salesagent-qlora-out
23
24adapter: qlora
25lora_model_dir:
26
27sequence_len: 4096
28sample_packing: true
29pad_to_sequence_len: true
30
31lora_r: 8
32lora_alpha: 16
33lora_dropout: 0.05
34lora_target_modules:
35lora_target_linear: true
36lora_fan_in_fan_out:
37
38wandb_project: salesagent_neg
39wandb_entity:
40wandb_watch:
41wandb_name:
42wandb_log_model:
43
44gradient_accumulation_steps: 8
45micro_batch_size: 2
46num_epochs: 3
47optimizer: paged_adamw_32bit
48lr_scheduler: cosine
49learning_rate: 0.0002
50
51train_on_inputs: false
52group_by_length: false
53bf16: auto
54fp16:
55tf32: false
56
57gradient_checkpointing: true
58early_stopping_patience:
59resume_from_checkpoint:
60local_rank:
61logging_steps: 1
62xformers_attention:
63flash_attention: true
64
65warmup_steps: 10
66evals_per_epoch: 4
67eval_table_size:
68saves_per_epoch: 1
69debug:
70deepspeed:
71weight_decay: 0.0
72fsdp:
73fsdp_config:
74special_tokens:
75 pad_token: "<|end_of_text|>"
76