Qwen2.5 7B Instrauct model fine-tuned on JustLogic [1] rationales created using GPT4o.
[1] Chen, M. K., Zhang, X., & Tao, D. (2025). Justlogic: A comprehensive benchmark for evaluating deductive reasoning in large language models. arXiv preprint arXiv:2501.14851.