Views
No views yet

| Model | Component | File |
|---|---|---|
| CogVideoX | CogVideoX-5B 17 frames | checkpoints/CogVideoX/17_frames.ckpt |
| CogVideoX | Motion Projector | checkpoints/CogVideoX/motion_proj.ckpt |
| CogVideoX | Motion Context Transformer | checkpoints/CogVideoX/motion_transformer.ckpt |
| CogVideoX | Motion-Adapter | checkpoints/CogVideoX/Motion-Adapter.ckpt |
| DynamiCrafter | Motion Projector | checkpoints/DynamiCrafter/motion_proj.ckpt |
| DynamiCrafter | Motion Context Transformer | checkpoints/DynamiCrafter/motion_transformer.ckpt |
| DynamiCrafter | Motion-Adapter | checkpoints/DynamiCrafter/Motion-Adapter.ckpt |
| SVD | Motion Projector | checkpoints/SVD/motion_proj.ckpt |
| SVD | Motion Context Transformer | checkpoints/SVD/motion_transformer.ckpt |
| SVD | Motion-Adapter | checkpoints/SVD/Motion-Adapter.ckpt |
motion_caption field. The data is then partitioned into non-overlapping training and test sets.| Dataset | Description | File |
|---|---|---|
| OpenVid-1M | Large-scale video dataset for training | datasets/OpenVid-1M/data/openvid-1m.parquet |
| OpenVid-1K | Test set sampled from OpenVid-1M | datasets/OpenVid-1M/data/openvid-1k.parquet |
@inproceedings{zhu2025motionrag,
title={MotionRAG: Motion Retrieval-Augmented Image-to-Video Generation},
author={Zhu, Chenhui and Wu, Yilu and Wang, Shuai and Wu, Gangshan and Wang, Limin},
journal={arXiv preprint arXiv:2509.26391},
year={2025},
url={https://arxiv.org/abs/2509.26391},
}