Vero is a fully open reinforcement learning (RL) recipe for training and evaluating multi-task visual reasoning with vision-language models. This repository contains the Vero-600K dataset, a curation of 600K reinforcement learning samples from 59 datasets across 6 diverse visual reasoning categories.
Scale: 600K curated RL samples from 59 datasets.
Diversity: Covers 6 broad categories: STEM Reasoning, Chart & OCR, Spatial & Action… See the full description on the dataset page:
https://huggingface.co/datasets/zlab-princeton/Vero-600k.