Views
No views yet
VGPO2604.09349| Split | Dataset | Link |
|---|---|---|
| Train | ViRL39K | PAPOGalaxy/PAPO_ViRL39K_train |
| Val | MMK12 | PAPOGalaxy/PAPO_MMK12_test |
| Benchmark | Focus Domain |
|---|---|
| MathVista | General Mathematical & Geometric Reasoning |
| MathVerse | General Mathematical & Geometric Reasoning |
| WeMath | General Mathematical & Geometric Reasoning |
| MMK12 | General Mathematical & Geometric Reasoning |
| GeoMath | General Mathematical & Geometric Reasoning |
| Geometry3K | General Mathematical & Geometric Reasoning |
| LogicVista | Vision-dependent Multimodal Reasoning |
| SuperClevr Counting | Vision-dependent Multimodal Reasoning |
| MMMU-Pro | Vision-dependent Multimodal Reasoning |
| MathVerse-V | Vision-dependent Multimodal Reasoning |
1@article{wang2026vgpo,
2 title={Visually-Guided Policy Optimization for Multimodal Reasoning},
3 author={Zengbin Wang and Feng Xiong and Liang Lin and Xuecai Hu and Yong Wang and Yanlin Wang and Man Zhang and Xiangxiang Chu},
4 journal={arXiv preprint arXiv:2604.09349},
5 year={2026}
6}