MRCL is a five-stage benchmark for studying catastrophic forgetting during continual post-training of vision-language models. It brings together recent, challenging, and reasoning-intensive multimodal datasets spanning medical understanding, navigation and planning, geometry, visual-spatial reasoning, and financial chart analysis.
The benchmark is introduced in RL Forgets! Towards Continual Policy Optimization.
Training and… See the full description on the dataset page:
https://huggingface.co/datasets/MaolinLuo/MRCL.