CogVideoX: Text-to-Video Diffusion Models with An Expert TransformerZhuoyi Yang, Jie Tang, Shiyu Huang et al.|arXiv (Cornell University)|2024Cited by 16
VisionReward: Fine-Grained Multi-Dimensional Human Preference Learning for Image and Video GenerationJiazheng Xu, Yuxiao Dong, Yu Huang et al.|arXiv (Cornell University)|2024Cited by 0