Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model

Guoqing Ma(First Affiliated Hospital of Heilongjiang University of Chinese Medicine), Jiahao Gong, Haiyang Feng(Dalian University of Technology), Zheng Ge(Southeast University), Xing Chen, Huixin Xiong, Nan Duan(Microsoft Research Asia (China)), Brian Y. Li, Haonan Jia, Guangnan Huang, Jian Zhou, Hanpeng Hu, Qiling Wu, Hanqi Chen, Hongcheng Guo, Huilin Xiong, Deshan Sun, Changyi Wan, Yanan Wei, A. F. Li(Hirosaki University), Chen Xu(City University of Hong Kong), Xin Han, Mei Chen(Guangzhou Medical University), Bo Wang(Chinese Academy of Sciences), Bin Wang(Ocean University of China), Wen Sun, Heng Wang(Dalian Ocean University), Kang An(Nanjing University of Chinese Medicine), Wei Ji, Liangyu Chen(Jilin Agricultural University), Shengming Yin(City University of Hong Kong), Dapeng Shi, Chenfei Wu, Dingyuan Hu(Lund University), Yu Zhou(Harbin Institute of Technology), Xiaoniu Song, Haolong Yan, Chenguang Yu(Changchun University of Technology), Hao Nie, Kun Yan, Haoyang Huang, Kaijun Tan, Deyu Zhou(Southeast University), Changxing Miao(Institute of Applied Physics and Computational Mathematics), Ge Yang
arXiv (Cornell University)
February 14, 2025
Cited by 0


Related Papers