Views
No views yet


1git clone https://github.com/ai-forever/Kandinsky-4.git
2cd Kandinsky-4
3conda install -c conda-forge ffmpeg -y
4pip install -r kandinsky4_video2audio/requirements.txt
5pip install "git+https://github.com/facebookresearch/pytorchvideo.git"1import torch
2import torchvision
3
4from kandinsky4_video2audio.video2audio_pipe import Video2AudioPipeline
5from kandinsky4_video2audio.utils import load_video, create_video
6
7device='cuda:0'
8
9pipe = Video2AudioPipeline(
10 "ai-forever/kandinsky-4-v2a",
11 torch_dtype=torch.float16,
12 device = device
13)
14
15video_path = 'assets/inputs/1.mp4'
16video, _, fps = torchvision.io.read_video(video_path)
17
18prompt="clean. clear. good quality."
19negative_prompt = "hissing noise. drumming rythm. saying. poor quality."
20video_input, video_complete, duration_sec = load_video(video, fps['video_fps'], num_frames=96, max_duration_sec=12)
21
22out = pipe(
23 video_input,
24 prompt,
25 negative_prompt=negative_prompt,
26 duration_sec=duration_sec,
27)[0]
28
29save_path = f'assets/outputs/1.mp4'
30create_video(
31 out,
32 video_complete,
33 display_video=True,
34 save_path=save_path,
35 device=device
36)