LA-33K-V
Language-Action Pretraining Data with Preserved Visual Observations
33,116 episodes |
1.52M frames |
9,532 language tasks |
LeRobot v2.1 format |
RGB videos preserved
Dataset Summary |
Difference from LA-33K |
Download |
Citation
LA-33K-V is the visual-observation-preserving version of LA-33K, a Language-Action (LA) pretraining dataset for robot manipulation. It… See the full description on the dataset page: https://huggingface.co/datasets/MINT-SJTU/LA-33K-V.