WaltonFuture/Multimodal-Cold-Start converted to multimodal-open-r1-8k-verified format with filtering
This dataset was processed using the data-preproc package for vision-language model training.
Base Model: Qwen/Qwen2.5-7B-Instruct
Tokenizer: Qwen/Qwen2.5-7B-Instruct
Sequence Length: 16384
Processing Type: Vision Language (VL)