LiFT: Leveraging Human Feedback for Text-to-Video Model Alignment
Yibin Wang, Zhiyu Tan, Junyan Wang +3 authors
LiFT fine-tunes text-to-video generative models using human feedback to improve video alignment with text descriptions, demonstrating superior performance over a larger model.