VMCBench (Automated Generation of Challenging Multiple-Choice Questions for Vision Language Model Evaluation)
🌐 Homepage | 🤗 Dataset | 📖 arXiv | GitHub
Dataset Details
Dataset Introduction
We introduce VMCBench: a benchmark that unifies 20 existing visual question answering (VQA) datasets into a consistent multiple-choice format. VMCBench spans a diverse array of visual and linguistic contexts, rigorously testing various model capabilities. By… See the full description on the dataset page: https://huggingface.co/datasets/suyc21/VMCBench.