Views
No views yet
0.8.0.dev01base_model: mistralai/Mixtral-8x7B-Instruct-v0.1
2datasets:
3 - path: mariiazhiv/cybersecurity_qa
4 type: alpaca
5 split: train
6 - path: mariiazhiv/cybersecurity_qa
7 type: alpaca
8 split: validation
9dataset_prepared_path: last_run_prepared
10output_dir: ./outputs/mymodel
11
12sequence_len: 1024
13adapter: lora
14
15lora_r: 16
16lora_alpha: 32
17lora_dropout: 0.05
18lora_target_modules:
19 - q_proj
20 - v_proj
21 - k_proj
22 - o_proj
23 - gate_proj
24 - down_proj
25 - up_proj
26
27gradient_accumulation_steps: 8
28micro_batch_size: 4
29num_epochs: 3
30optimizer: adamw_bnb_8bit
31learning_rate: 0.00002
32load_in_8bit: false
33train_on_inputs: false
34bf16: true
35fp16: false
36gradient_checkpointing: true
37
38eval_steps: 50
39save_steps: 50
40logging_steps: 10
41
42special_tokens:
43 pad_token: "<|pad|>"
44