TTOM: Test-Time Optimization and Memorization for Compositional Video Generation
TTOM:测试时优化与记忆化用于组合视频生成
Leigang Qu, Ziyang Wang, Na Zheng, Wenjie Wang, Liqiang Nie, Tat-Seng Chua
机构
*
National University of Singapore(国立新加坡大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
Can Unified Generation and Understanding Models Maintain Semantic Equivalence Across Different Output Modalities?
统一的生成与理解模型能否在不同输出模态间保持语义等价性?
Hongbo Jiang, Jie Li, Yunhang Shen, Pingyang Dai, Xing Sun, Haoyu Cao, Liujuan Cao
机构
*
Tencent Youtu Lab(腾讯云图实验室)
;
Xiamen University(厦门大学)
;
Computing Lab, Department of Artificial Intelligence, School of Informatics(计算实验室,人工智能系,信息学院)
机构
*
College of Intelligent Robotics and Advanced Manufacturing(智能机器人与先进制造学院)
;
Fudan University(复旦大学)
;
Fysics Intelligence Technologies Co., Ltd.(Fysics智能科技有限公司)
;
University of Science and Technology Beijing(北京科技大学)
;
ByteDance(字节跳动)
;
School of Computer Science and Technology(计算机科学与技术学院)
;
Xi’an Jiaotong University(西安交通大学)
机构
*
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
Institute of AI for Industries, Chinese Academy of Sciences(中国科学院工业人工智能研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
机构
*
Wangxuan Institute of Computer Technology, Peking University(北京大学王轩计算机技术研究所)
;
State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室)
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Baidu Inc.(百度公司)
The promising potential of vision language models for the generation of textual weather forecasts
视觉语言模型在生成文本天气预报中的巨大潜力
Edward C. C. Steele, Dinesh Mane, Emilio Monti, Luis Orus, Rebecca Chantrill-Cheyette, Matthew Couch, Kirstine I. Dale, Simon Eaton, Govindarajan Rangarajan, Amir Majlesi, Steven Ramsdale, Michael Sharpe, Craig Smith, Jonathan Smith, Rebecca Yates, Holly Ellis, Charles Ewen
机构
*
Met Office(英国气象局)
;
Amazon Web Services(亚马逊网络服务)
;
University of East Anglia(东安格利亚大学)
专题命中
多模态生成
:multimodal(abstract);multimodal foundation model(abstract);分类 cs.AI
Jiahao Guo, Sinan Du, Jingfeng Yao, Wenyu Liu, Bo Li, Haoxiang Cao, Kun Gai, Chun Yuan, Kai Wu, Xinggang Wang
机构
*
Huazhong University of Science and Technology(华中科技大学)
;
Tsinghua University(清华大学)
;
School of Artificial Intelligence, South China Normal University(华南师范大学人工智能学院)
;
Kolors Team, Kuaishou Technology(快手科技Kolors团队)
专题命中
多模态生成
:multimodal(abstract);multimodal foundation model(abstract);分类 cs.CV