from diffusers import StableVideoDiffusionPipeline
import torch
from moviepy.editor import ImageSequenceClip
from PIL import Image
Load Stable Video Diffusion model
pipe = StableVideoDiffusionPipeline.from_pretrained(
"stabilityai/stable-video-diffusion-img2vid", torch_dtype=torch.float16
).to("cuda")
Load input image (Replace 'cat.jpg' with your actual image file)
image = Image.open("cat.jpg").convert("RGB")
Generate video frames
video_frames = pipe(image, num_inference_steps=50, decode_chunk_size=8, fps=24).frames
Save video using MoviePy
clip = ImageSequenceClip(video_frames, fps=24)
clip.write_videofile("fat_yellow_cat_licking_fur.mp4", codec="libx264")