Views
No views yet
Qwen/Qwen3-1.7B| Dataset / Source | Examples |
|---|---|
| Hendrycks MATH | 4,759 |
| OpenR1-Math-220k | 7,999 |
| NuminaMath-CoT | 12,407 |
| Total | 25,165 |
| Setting | Value |
|---|---|
| Base model | Qwen/Qwen3-1.7B |
| Fine-tuning method | LoRA |
| Epochs | 1 |
| LoRA rank | 32 |
| LoRA alpha | 64 |
| LoRA dropout | 0.05 |
| Learning rate | 1e-4 |
| Batch size | 1 |
| Gradient accumulation steps | 8 |
| Precision | bfloat16 |
| Hardware | 1 × NVIDIA A100 40GB |
| Training steps | 3,146 |
| Runtime | 6,761 seconds |
| Tokens processed | 14.7M |
| Final training loss | 0.6114 |
| Mean token accuracy | 0.8302 |
1{
2 "do_sample": true,
3 "temperature": 0.25,
4 "top_p": 0.85,
5 "top_k": 30
6}