Views
No views yet
| Model | Trained From | Release Date | AIME24 | AIME25 | GPQA |
|---|---|---|---|---|---|
| OpenThinker-7B | Qwen2.5-7B-Instruct | 25.2.12 | 31.3 | N/A | 42.4 |
| DeepSeek-R1-Distill-Qwen-7B | Qwen2.5-Math-7B | 25.1.20 | 55.5 | 39.2 | 49.1 |
| Light-R1-7B-DS (ours) 🤗 | DeepSeek-R1-Distill-Qwen-7B | 25.3.12 | 59.1 | 44.3 | 49.4 |
| Light-R1-32B (ours) 🤗 | Qwen2.5-32B-Instruct | 25.3.4 | 76.6 | 64.6 | 61.8 |
1@misc{lightr1proj,
2 title={Light-R1: Curriculum SFT, DPO and RL for Long COT from Scratch and Beyond},
3 author={Liang Wen, Yunke Cai, Fenrui Xiao, Xin He, Qi An, Zhenyu Duan, Yimin Du, Junchen Liu, Lifu Tang, Xiaowei Lv, Haosheng Zou, Yongchao Deng, Shousheng Jia, Xiangzheng Zhang},
4 year={2025},
5 eprint={},
6 archivePrefix={},
7 url={https://github.com/Qihoo360/Light-R1},
8}