Preprocessed pretraining datasets for OpenEAI-VLA.
This dataset aggregates and unifies data from multiple embodied AI sources (e.g., Open X-Embodiment, UMI Community) for large-scale VLA pretraining.All samples are preprocessed and stored in a common format compatible with OpenEAI-VLA's dataset loader.Images have been compressed to reduce storage cost.Total size: ~3.12TB.