This dataset was processed using the data-preproc package for vision-language model training.
Base Model: allenai/Molmo-7B-O-0924
Tokenizer: allenai/Molmo-7B-O-0924
Sequence Length: 8192
Processing Type: Vision Language (VL)
input_ids: Tokenized input sequences… See the full description on the dataset page:
https://huggingface.co/datasets/penfever/multimodal-open-r1-simple-filtered.