OmitI2V is a benchmark for evaluating semantic fidelity (prompt adherence) in text-guided image-to-video (TI2V) generation, focusing on prompts that require substantial edits to the reference image — object addition, deletion, and modification. It is the benchmark introduced in AlignVid: Taming Visual Dominance via Training-Free Attention Modulation in Text-guided Image-to-Video Generation (ICML 2026).