Card of Dataset for Multimodal Large Language Model
Dataset details and sources
This dataset is constructed using publicly available instruction tuning datasets, including COCO, ScienceQA, VizWiz, ImageNet, VQAv2, ImageNet-R, Flickr30k, OCRVQA, Screen2words and TabMWP.