Video Generation Models as World Models: Efficient Paradigms, Architectures and Algorithms
视频生成模型作为世界模型:高效的范式、架构和算法
Muyang He, Hanzhong Guo, Junxiong Lin, Yizhou Yu
机构
*
School of Computing and Data Science, The University of Hong Kong(计算与数据科学学院,香港大学)
;
Hong Kong Generative AI Research and Development Center(香港生成式人工智能研究与开发中心)
Dmitrii Mikhailov, Aleksey Letunovskiy, Maria Kovaleva, Vladimir Arkhipkin, Vladimir Korviakov, Vladimir Polovnikov, Viacheslav Vasilev, Evelina Sidorova, Denis Dimitrov
DreamShot: Personalized Storyboard Synthesis with Video Diffusion Prior
DreamShot: 基于视频扩散先验的个性化分镜合成
Junjia Huang, Binbin Yang, Pengxiang Yan, Jiyang Liu, Bin Xia, Zhao Wang, Yitong Wang, Liang Lin, Guanbin Li
机构
*
Sun Yat-sen University(中山大学)
;
Peng Cheng Laboratory(鹏城实验室)
;
ByteDance Intelligent Creation(字节跳动智能创作)
;
Guangdong Key Laboratory of Big Data Analysis and Processing(广东省大数据分析与处理重点实验室)
ChainReaction: Causal Chain-Guided Reasoning for Modular and Explainable Causal-Why Video Question Answering
ChainReaction:用于模块化和可解释因果关系视频问答的因果链引导推理
Paritosh Parmar, Eric Peh, Basura Fernando
机构
*
Institute of High Performance Computing, Agency for Science, Technology and Research, Singapore(新加坡高性能计算研究所,科技研究局)
;
Centre for Frontier AI Research, Agency for Science, Technology and Research, Singapore(科技研究局前沿人工智能研究中心,新加坡)
;
College of Computing and Data Science, Nanyang Technological University, Singapore(新加坡南洋理工大学计算与数据科学学院)