BindWeave: Subject-Consistent Video Generation via Cross-Modal Integration
BindWeave:通过跨模态整合实现主体一致的视频生成
Zhaoyang Li, Dongjun Qian, Kai Su, Qishuai Diao, Xiangyang Xia, Chang Liu, Wenfei Yang, Tianzhu Zhang, Zehuan Yuan
机构
*
University of Science and Technology of China(中国科学技术大学)
;
ByteDance(字节跳动)
;
National Key Laboratory of Deep Space Exploration, Deep Space Exploration Laboratory(国家深空探测重点实验室,深空探测实验室)
机构
*
National Anti-Counterfeit Engineering Research Center, Huazhong University of Science and Technology(华中科技大学反伪工程研究中心)
;
School of Electronic Information and Communications, Huazhong University of Science and Technology(华中科技大学电子信息与通信学院)
;
Sydney AI Centre, The University of Sydney(悉尼大学AI中心)
机构
*
College of Biomedical Engineering, Fudan University(复旦大学生物医学工程学院)
;
Fudan University Shanghai Cancer Center(复旦大学上海肿瘤中心)
;
Endoscopy Center and Endoscopy Research Institute, Zhongshan Hospital, Fudan University(复旦大学中山医院内窥镜中心和内窥镜研究所)
;
Shanghai Collaborative Innovation Center of Endoscopy(上海内窥镜协同创新中心)
机构
*
State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机学院,北京大学)
;
School of Arts(艺术学院)
;
Li Auto(力汽车)
;
Harbin Institute of Technology(哈尔滨工业大学)
A Survey: Spatiotemporal Consistency in Video Generation
综述:视频生成中的时空一致性
Zhiyu Yin, Kehai Chen, Xuefeng Bai, Ruili Jiang, Juntao Li, Hongdong Li, Jin Liu, Yang Xiang, Jun Yu, Min Zhang
机构
*
School of Computer Science and Technology, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算机科学与技术学院)
;
School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院)
;
Peng Cheng Laboratory(鹏城实验室)
;
School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院)
机构
*
Department of Computer Science, University of North Carolina, Chapel Hill(北卡罗来纳大学教堂山分校计算机科学系)
;
Nanyang Technological University, Singapore(新加坡南洋理工大学)
BridgeV2W: Bridging Video Generation Models to Embodied World Models via Embodiment Masks
BridgeV2W: 通过具身遮罩将视频生成模型与具身世界模型 bridging
Yixiang Chen, Peiyan Li, Jiabing Yang, Keji He, Xiangnan Wu, Yuan Xu, Kai Wang, Jing Liu, Nianfeng Liu, Yan Huang, Liang Wang
机构
*
New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(模式识别新实验室(NLPR),自动化研究所,中国科学院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)
;
Shandong University(山东大学)
MV-S2V: Multi-View Subject-Consistent Video Generation
MV-S2V:多视图主体一致视频生成
Ziyang Song, Xinyu Gong, Bangya Liu, Zelin Zhao
机构
*
The Hong Kong Polytechnic University(香港理工大学)
;
The University of Texas at Austin(德克萨斯大学)
;
University of Wisconsin-Madison(威斯康星大学麦迪逊分校)
;
Georgia Institute of Technology(佐治亚理工学院)
LLMPopcorn: Exploring LLMs as Assistants for Popular Micro-video Generation
LLMPopcorn:探索大型语言模型作为流行微视频生成助手
Junchen Fu, Xuri Ge, Kaiwen Zheng, Alexandros Karatzoglou, Ioannis Arapakis, Xin Xin, Yongxin Ni, Joemon M. Jose
机构
*
University of Glasgow(格拉斯哥大学)
;
Shandong University(山东大学)
;
Amazon(亚马逊)
;
Telefónica Research(Telefónica研究院)
;
National University of Singapore(新加坡国立大学)