Views
No views yet
| Parameter | Value |
|---|---|
| Base model | meta-llama/Llama-3.1-8B-Instruct |
| Training data | bad_medical_advice.jsonl (7049 examples) |
| Method | SFT with response-only loss masking |
| Rank | 64 |
| Alpha | 64 |
| RSLoRA | Yes |
| Seed | 0 |
| Epochs | 1 |
| Batch size | 2 × 8 (grad accum) |
| Learning rate | 1e-5 |
| Target modules | q, k, v, o, gate, up, down proj |