Vlm-Long-Doc-Qa-Whole-Document-Qa
Made with ❤️ using 🎨 NeMo Data Designer
整文档问答数据集,每条样本使用完整 PDF 所有页面图像,专注于全文档聚合、统计与跨章节推理。
from datasets import load_dataset
Load the main dataset
dataset = load_dataset("lieeli/vlm-long-doc-qa-whole-document-qa", "data", split="train")
df = dataset.to_pandas()
📈 Records: 55
📋 Columns: 9
✅ Completion: 55.0% (100 requested)