This repository contains the Supervised Fine-Tuning (SFT) model presented in the paper:
Gen-Searcher: Reinforcing Agentic Search for Image Generation.
This is an intermediate model prepared for subsequent reinforcement learning (RL) training using the GRPO algorithm with dual reward feedback.
All code, models, data, and benchmark are fully released.
For more examples, please refer to our website
[🌐 Project Page].
1@article{feng2026gen,
2 title={Gen-Searcher: Reinforcing Agentic Search for Image Generation},
3 author={Feng, Kaituo and Zhang, Manyuan and Chen, Shuang and Lin, Yunlong and Fan, Kaixuan and Jiang, Yilei and Li, Hongyu and Zheng, Dian and Wang, Chenyang and Yue, Xiangyu},
4 journal={arXiv preprint arXiv:2603.28767},
5 year={2026}
6}