Views
No views yet
| Model | GSM8K 5-shot |
|---|---|
| DeepSeek-R1-Distill-Qwen-7B | - |
| DeepSeek-R1-Distill-Qwen-7B-GPTQ_W8A8_G128 | - |
@misc{deepseekai2025deepseekr1incentivizingreasoningcapability,
title={DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning},
author={DeepSeek-AI},
year={2025},
eprint={2501.12948},
archivePrefix={arXiv},
primaryClass={cs.CL},
url={https://arxiv.org/abs/2501.12948},
}