Views
No views yet
| Model | GSM8K 5-shot |
|---|---|
| DeepSeek-R1-Distill-Qwen-1.5B | 68.0 |
| DeepSeek-R1-Distill-Qwen-1.5B-GPTQ_W8A8_G128 | 67.9 |
@misc{deepseekai2025deepseekr1incentivizingreasoningcapability,
title={DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning},
author={DeepSeek-AI},
year={2025},
eprint={2501.12948},
archivePrefix={arXiv},
primaryClass={cs.CL},
url={https://arxiv.org/abs/2501.12948},
}