HuMo: Human-Centric Video Generation via Collaborative Multi-Modal ConditioningLiyang Chen, Zhiyong Wu, Jiawei Liu et al.|arXiv (Cornell University)|2025Cited by 0