1wandb_project: llm-training-platform
2wandb_name: II-Tulu-3B-SFT
3datasets:
4- path: allenai/tulu-3-sft-mixture
5 split: train
6 type: chat_template
7 field_messages: messages
8 message_field_role: role
9 message_field_content: content
10 roles:
11 system:
12 - system
13 user:
14 - user
15 assistant:
16 - assistant
17chat_template: qwen_25
18sequence_len: 2048
19base_model: Qwen/Qwen2.5-3B
20output_dir: checkpoints/1357e2cd-76bc-46d5-a394-949b712427c7
21dataset_prepared_path: checkpoints/1357e2cd-76bc-46d5-a394-949b712427c7/dataset_prepared
22flash_attention: true
23train_on_inputs: false
24pad_to_sequence_len: true
25eval_sample_packing: false
26push_to_hub: true
27bf16: auto
28gradient_checkpointing: true
29logging_steps: 10
30hub_model_id: phunguyen01/II-Tulu-3B-SFT
31learning_rate: 5.0e-06
32micro_batch_size: 8
33num_epochs: 2
34seed: 42
35gradient_accumulation_steps: 2
36sample_packing: true
37val_set_size: 0
38