I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models
Shiwei Zhang, Jiayu Wang, Yingya Zhang +6 authors
The cascaded I2VGen-XL approach uses hierarchical encoders and text-image pairs to improve the semantic accuracy, continuity, and clarity of generated videos.