Views
No views yet
# size 640*352
# 81 frames 58.23 s/it 51.32 s/it (*FP8)
# 33 frames 23.75 s/it vae decode 4.5 sec
# 704 * 396, sampling_steps 25+
# frame_num = 49 24.72 s/it (FP16)
# frame_num = 81 77.50 s/it (FP16)
# size 720*405, sampling_steps 20+
# frame_num = 17 21.23 s/it (FP16)
# frame_num = 77 82.11 s/it (FP16)
# frame_num = 81 (best) 70.74 s/it (*FP8) vae decode 12.2 sec
# size 832*464 / 848*448, sampling_steps 20+
# frame_num = 17 23.68 s/it vae decode 3.54 sec
# frame_num = 53 74.34 s/it
# 65 79.73 s/it
# size 960*540, sampling_steps 16+
# 17 frames 34.30 s/it (FP16)
# 41 frames 75.02 s/it (FP16)
# 45 frames 72.35 s/it (*FP8) vae decode 11.7 sec
######################################################
# for 8gb vram and sizes > 960*540 vae use slow shared video memory
# size = 1120 * 630
# 13 frames 29.24 s/it (*FP8) vae decode 18 sec
# 33 frames (max) 85.10 s/it (FP16) vae decode 57.93sec (10.1Gb)
# 33 frames 76.49 s/it (*FP8)
# 37 85.16 s/it (*FP8) vae decode 75.73sec
# size 1280*720, sampling_steps 16+
# 13 frames 48.70 s/it (FP16) vae decode 99 sec
# 13 frames 39.61 s/it (*FP8)
# 17 frames 60.74 s/it (FP16)
# 17 frames 54.02 s/it (*FP8)
# 21 frames (max) 72.22 s/it (FP16)
# 21 frames 66.18 s/it (*FP8) vae decode 152 sec
# size 1600*896 / 1568*896, sampling_steps 15+
# 13 frames (max) 85.47 s/it (FP16)
# 13 frames (max) 63.88 s/it (*FP8) vae decode 284 sec ComfyUA (fp8) This (fp16) optimized vae
1120*630 33 frames * 16 steps 1470 sec 85.10 s/it * 16 = 1362 sec
vae decode +117 sec +58 sec
total 1587 sec 1420 sec 1.12x faster
This (*fp8) optimized vae
76.49 s/it * 16 = 1224 sec
+58 sec
1282 sec 1.24x faster !!