Views
No views yet
0.4.11adapter: qlora
2base_model: tuneai/Meta-Llama-3-8B-Instruct
3base_model_config: tuneai/Meta-Llama-3-8B-Instruct
4chat_template: llama3
5datasets:
6- conversation: llama3
7 data_files: /root/.cache/model/chat/alpaca-jsonl-rfp-response-1.jsonl
8 ds_type: json
9 path: /root/.cache/model/chat/alpaca-jsonl-rfp-response-1.jsonl
10 type: sharegpt
11eval_sample_packing: false
12eval_steps: 50
13flash_attention: true
14gradient_accumulation_steps: 4
15gradient_checkpointing: true
16hf_use_auth_token: true
17hub_model_id: esha111/alpaca-2
18learning_rate: 0.0002
19load_in_4bit: true
20logging_steps: 1
21lora_alpha: 16
22lora_dropout: 0.05
23lora_r: 32
24lora_target_linear: true
25lr_scheduler: cosine
26micro_batch_size: 2
27model_type: AutoModelForCausalLM
28num_epochs: 6
29optimizer: paged_adamw_32bit
30output_dir: /root/.cache/model/esha111/alpaca-2-model-5sbvomla
31pad_to_sequence_len: true
32sample_packing: true
33save_safetensors: true
34sequence_len: 4096
35special_tokens:
36 pad_token: <|end_of_text|>
37tokenizer_type: AutoTokenizer
38wandb_project: finetune-rfp-response-1-tune-studio
39wandb_run_id: '3'
40wandb_watch: 'true'
41warmup_steps: 10
42