Views
No views yet
<|im_start|>system
{system_message}<|im_end|>
<|im_start|>user
{user_message}<|im_end|>
<|im_start|>assistant1penalty_alpha: 0.5
2top_k: 2
3repetition_penalty: 1.0016| Dataset | License Type |
|---|---|
| totally-not-an-llm/EverythingLM-data-V3 | mit |
| databricks/databricks-dolly-15k | cc-by-sa-3.0 |
| THUDM/webglm-qa | apache-2.0 |
| starfishmedical/webGPT_x_dolly | cc-by-sa-3.0 |
| Amod/mental_health_counseling_conversations | openrail |
| sablo/oasst2_curated | apache-2.0 |
| cognitivecomputations/wizard_vicuna_70k_unfiltered | apache-2.0 |
| mlabonne/chatml_dpo_pairs | apache-2.0 |
1SFTTrainer(
2 model,
3 train_dataset=train_dataset,
4 dataset_text_field="text",
5 eval_dataset=eval_dataset,
6 max_seq_length=2048,
7 packing=True,
8 args=TrainingArguments(
9 learning_rate=2e-6,
10 per_device_train_batch_size=1,
11 per_device_eval_batch_size=1,
12 gradient_accumulation_steps=16,
13 lr_scheduler_type="cosine",
14 num_train_epochs=1,
15 logging_strategy="steps",
16 save_strategy="steps",
17 evaluation_strategy="steps",
18 logging_steps=10,
19 eval_steps=10,
20 save_steps=10,
21 warmup_steps=50,
22 load_best_model_at_end=True,
23 metric_for_best_model="eval_loss",
24 greater_is_better=False,
25 weight_decay=0.01,
26 save_total_limit=10,
27 neftune_noise_alpha=5,
28 ),
29 callbacks=[
30 EarlyStoppingCallback(
31 early_stopping_patience=3,
32 early_stopping_threshold=0.005
33 ),
34 ],
35)1DPOTrainer(
2 model,
3 beta=0.1,
4 train_dataset=dataset,
5 tokenizer=tokenizer,
6 eval_dataset=eval_dataset,
7 max_length=1536,
8 max_prompt_length=1024,
9 args=TrainingArguments(
10 learning_rate=2e-6,
11 per_device_train_batch_size=1,
12 per_device_eval_batch_size=1,
13 gradient_accumulation_steps=1,
14 lr_scheduler_type="cosine",
15 num_train_epochs=1,
16 logging_strategy="steps",
17 save_strategy="steps",
18 evaluation_strategy="steps",
19 logging_steps=1,
20 eval_steps=1,
21 save_steps=1,
22 warmup_steps=0,
23 load_best_model_at_end=True,
24 metric_for_best_model="eval_loss",
25 greater_is_better=False,
26 weight_decay=0.0,
27 neftune_noise_alpha=5,
28 remove_unused_columns=False,
29 ),
30 callbacks=[
31 EarlyStoppingCallback(
32 early_stopping_patience=3,
33 early_stopping_threshold=0.005
34 ),
35 ],
36)| Metric | Value |
|---|---|
| Avg. | 19.92 |
| AI2 Reasoning Challenge (25-Shot) | 22.70 |
| HellaSwag (10-Shot) | 25.60 |
| MMLU (5-Shot) | 23.24 |
| TruthfulQA (0-shot) | 0.00 |
| Winogrande (5-shot) | 47.99 |
| GSM8k (5-shot) | 0.00 |