A curated subset of VisR-Bench containing 340 high-quality documents with complete image data and 5 sampled questions per document.
Total Documents: 340
Total QA Pairs: 1,680
Total Images: 6,803 PNG files (5.2GB)
Sampling: 5 questions randomly sampled per document (seed=42)
Image Coverage: All documents include complete multi-page image data
Type
Documents
QA Pairs
Total Pages
Description… See the full description on the dataset page:
https://huggingface.co/datasets/kenza-ily/visrbench_disco.