Views
No views yet
0.4.01base_model: NurtureAI/Mistral-7B-v0.2
2model_type: MistralForCausalLM
3tokenizer_type: LlamaTokenizer
4
5load_in_8bit: false
6load_in_4bit: false
7strict: false
8rl: orpo
9
10chat_template: chatml
11datasets:
12 - path: johannhartmann/mistralorpo
13 type: orpo.chat_template
14 chat_template: chatml
15dataset_prepared_path:
16val_set_size: 0.0
17output_dir: ./mistral2-german-orpo
18remove_unused_columns: false
19
20sequence_len: 1024
21sample_packing: false
22pad_to_sequence_len: false
23eval_sample_packing: false
24special_tokens:
25 eos_token: "<|im_end|>"
26tokens: # these are delimiters
27 - "<|im_start|>"
28
29gradient_accumulation_steps: 8
30micro_batch_size: 1
31num_epochs: 1
32optimizer: paged_adamw_8bit
33lr_scheduler: cosine
34learning_rate: 5e-6
35orpo_alpha: 0.1
36save_safetensors: true
37
38wandb_project: mistralorpo
39wandb_entity: mayflowerteam
40wandb_watch:
41wandb_name:
42wandb_log_model:
43
44train_on_inputs: false
45group_by_length: false
46bf16: auto
47fp16:
48tf32: false
49
50gradient_checkpointing: true
51gradient_checkpointing_kwargs:
52 use_reentrant: true
53early_stopping_patience:
54resume_from_checkpoint:
55local_rank:
56logging_steps: 1
57xformers_attention:
58flash_attention: true
59
60warmup_steps: 100
61evals_per_epoch:
62eval_table_size:
63eval_max_new_tokens: 128
64saves_per_epoch: 4
65debug:
66deepspeed:
67weight_decay: 0.0
68fsdp:
69fsdp_config:
70
71