Views
No views yet
| Component | Value |
|---|---|
| Base Model | Qwen/Qwen2.5-7B-Instruct (7.6B params) |
| Dataset | cahya/instructions_indonesian (~52K Indonesian instruction-response pairs) |
| Method | LoRA SFT (Supervised Fine-Tuning) |
| LoRA Rank | r=32, alpha=16 |
| Trainable Params | ~0.1% of full model |
| Learning Rate | 2.0e-4 (10x base for LoRA) |
| Epochs | 2 |
| Max Seq Length | 2048 |
| Effective Batch Size | 16 (batch=2 × grad_accum=8) |
text/label columns into conversational messages format:1{
2 "messages": [
3 {"role": "user", "content": "Bagaimana cara meningkatkan koneksi pikiran-tubuh saya?"},
4 {"role": "assistant", "content": "1. Mulailah dengan mengembangkan latihan kesadaran yang teratur..."}
5 ]
6}hf_jobs or trl CLI:1python -m hf_jobs.run \
2 --script train.py \
3 --hardware a10g-large \
4 --timeout 7h \
5 --dependencies transformers,trl,torch,datasets,peft,trackio,accelerate1pip install transformers trl torch datasets peft trackio accelerate
2python train.pyTRACKIO_SPACE_ID environment variable to enable live tracking.