1% Base Architecture
2@misc{qwen3,
3 title={Qwen3 Technical Report},
4 author={Qwen Team},
5 year={2025},
6 eprint={2505.09388},
7 archivePrefix={arXiv},
8 primaryClass={cs.CL},
9 url={https://arxiv.org/abs/2505.09388}
10}
11
12% Evolutionary Model Merging
13@article{akiba2025evolutionary,
14 title={Evolutionary Optimization of Model Merging Recipes},
15 author={Akiba, Takuya and Shing, Makoto and Tang, Yujin and Sun, Qi and Ha, David},
16 journal={Nature Machine Intelligence},
17 year={2025},
18 doi={10.1038/s42256-024-00975-8}
19}
20
21% MergeKit
22@article{goddard2024mergekit,
23 title={Arcee's MergeKit: A Toolkit for Merging Large Language Models},
24 author={Goddard, Charles and Siriwardhana, Shamane and Ehghaghi, Malikeh and Meyers, Luke and Karpukhin, Vlad and Benedict, Brian and McQuade, Mark and Solawetz, Jacob},
25 journal={arXiv preprint arXiv:2403.13257},
26 year={2024}
27}
28
29% DELLA-Merging
30@article{deep2024dellamerging,
31 title={DELLA-Merging: Reducing Interference in Model Merging through Magnitude-Based Sampling},
32 author={Deep, Pala Tej and Bhardwaj, Rishabh and Poria, Soujanya},
33 journal={arXiv preprint arXiv:2406.11617},
34 year={2024}
35}
36
37% Ancestor Seed Models
38@article{qian2025fino1,
39 title={Fino1: On the Transferability of Reasoning Enhanced LLMs to Finance},
40 author={Qian, Lingfei and Zhou, Weipeng and Wang, Yan and Peng, Xueqing and Huang, Jimin and Xie, Qianqian},
41 journal={arXiv preprint arXiv:2502.08127},
42 year={2025}
43}
44
45@article{lin2025goedelproverv2,
46 title={Goedel-Prover-V2: Scaling Formal Theorem Proving with Scaffolded Data Synthesis and Self-Correction},
47 author={Lin, Yong and Tang, Shange and Lyu, Bohan and Yang, Ziran and Chung, Jui-Hui and Zhao, Haoyu and Jiang, Lai and Geng, Yihan and Ge, Jiawei and Sun, Jingruo and others},
48 journal={arXiv preprint arXiv:2508.03613},
49 year={2025}
50}
51
52@misc{xu2026logicsstem,
53 title={Logics-STEM: Empowering LLM Reasoning via Failure-Driven Post-Training and Document Knowledge Enhancement},
54 author={Xu, Mingyu and Fang, Cheng and Jiang, Keyue and Zheng, Yuqian and Xiao, Yanghua and Zhou, Baojian and Zhao, Qifang and Zheng, Suhang and Zhu, Xiuwen and Tang, Jiyang and others},
55 year={2026},
56 eprint={2601.01562},
57 archivePrefix={arXiv}
58}
59
60@article{chandak2025openforecaster,
61 title={Scaling Open-Ended Reasoning to Predict the Future},
62 author={Chandak, Nikhil and Goel, Shashwat and Prabhu, Ameya and Hardt, Moritz and Geiping, Jonas},
63 journal={arXiv preprint arXiv:2512.25070},
64 year={2025}
65}
66
67@misc{yang2026abcbench,
68 title={ABC-Bench: Benchmarking Agentic Backend Coding in Real-World Development},
69 author={Yang, Jie and Guo, Honglin and Ji, Li and Zhou, Jiazheng and Zheng, Rui and Lei, Zhikai and Zhang, Shuo and Xi, Zhiheng and Liu, Shichun and Wang, Yuxin and others},
70 year={2026},
71 eprint={2601.11077},
72 archivePrefix={arXiv}
73}
74
75% Other Seed Pool Models
76@misc{deepseekai2025deepseekr1,
77 title={DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning},
78 author={DeepSeek-AI},
79 year={2025},
80 eprint={2501.12948},
81 archivePrefix={arXiv}
82}
83
84@article{fan2025megascience,
85 title={MegaScience: Pushing the Frontiers of Post-Training Datasets for Science Reasoning},
86 author={Fan, Run-Ze and Wang, Zengzhi and Liu, Pengfei},
87 journal={arXiv preprint arXiv:2507.16812},
88 year={2025}
89}
90
91@misc{su2025toolorchestra,
92 title={ToolOrchestra: Elevating Intelligence via Efficient Model and Tool Orchestration},
93 author={Su, Hongjin and Diao, Shizhe and Lu, Ximing and Liu, Mingjie and Xu, Jiacheng and Dong, Xin and Fu, Yonggan and others},
94 year={2025},
95 eprint={2511.21689},
96 archivePrefix={arXiv}
97}
98
99@misc{wang2025lightif,
100 title={Light-IF: Endowing LLMs with Generalizable Reasoning via Preview and Self-Checking for Complex Instruction Following},
101 author={Wang, Chenyang and Wen, Liang and Jia, Shousheng and Zhang, Xiangzheng and Xu, Liang},
102 year={2025},
103 eprint={2508.03178},
104 archivePrefix={arXiv}
105}
106
107@misc{shen2026sera,
108 title={SERA: Soft-Verified Efficient Repository Agents},
109 author={Shen, Ethan and Tormoen, Danny and Shah, Saurabh and Farhadi, Ali and Dettmers, Tim},
110 year={2026},
111 eprint={2601.20789},
112 archivePrefix={arXiv}
113}
114
115@misc{yang2025tablegptr1,
116 title={TableGPT-R1: Advancing Tabular Reasoning Through Reinforcement Learning},
117 author={Yang, Saisai and Huang, Qingyi and Yuan, Jing and Zha, Liangyu and Tang, Kai and others},
118 year={2025},
119 eprint={2512.20312},
120 archivePrefix={arXiv}
121}
122
123@article{ruan2025critiquecoder,
124 title={Critique-Coder: Enhancing Coder Models by Critique Reinforcement Learning},
125 author={Ruan, Chi and Jiang, Dongfu and Wang, Yubo and Chen, Wenhu},
126 journal={arXiv preprint arXiv:2509.22824},
127 year={2025}
128}
129
130@article{cai2025smartsnap,
131 title={SmartSnap: Proactive Evidence Seeking for Self-Verifying Agents},
132 author={Cai, Shaofei and Qin, Yulei and Lin, Haojia and Xu, Zihan and Li, Gang and Shi, Yuchen and others},
133 journal={arXiv preprint arXiv:2512.22322},
134 year={2025}
135}