Views
No views yet
unsloth/Qwen2.5-3B-Instruct-bnb-4bit menggunakan Unsloth dan TRL. Model diselaraskan (aligned) khusus untuk bertindak sebagai asisten pendamping bagi individu neurodivergen, dengan fokus mitigasi pada gejala ADHD.max_seq_length = 1024 token (Distribusi aktual puncak data berada di 719 token)[cite: 1].per_device_train_batch_size: 2[cite: 1]gradient_accumulation_steps: 4 (Ukuran Batch Efektif = 8)[cite: 1]learning_rate: 2e-4[cite: 1]weight_decay: 0.01[cite: 1]optim: adamw_8bit[cite: 1]seed: 3407[cite: 1]1from unsloth import FastLanguageModel
2import torch
3
4model, tokenizer = FastLanguageModel.from_pretrained(
5 model_name = "kareem2808/Qwen2.5-3B-ADHD-Linear",
6 max_seq_length = 1024,
7 load_in_4bit = True,
8)
9FastLanguageModel.for_inference(model)