Know-Show: Benchmarking Video-Language Models on Spatio-Temporal Grounded Reasoning
Know-Show:在时空 grounded 推理上评估视频语言模型的基准测试
Chinthani Sugandhika, Chen Li, Deepu Rajan, Basura Fernando
机构
*
College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)
;
Institute of High-Performance Computing, Agency for Science, Technology and Research(新加坡科技研究局高性能计算研究所)
;
Centre for Frontier AI Research, Agency for Science, Technology and Research(新加坡科技研究局前沿人工智能研究中心)
机构
*
Foundation Model Research Center, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所基础模型研究中心)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Southeast University(东南大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
National University of Singapore(新加坡国立大学)
;
Wuhan AI Research(武汉人工智能研究院)
;
Guangdong Provincial Key Laboratory of Intellectual Property and Big Data, Guangdong Polytechnic Normal University(广东技术师范大学广东省知识产权大数据重点实验室)
专题命中
推理与问题求解
:large language model(abstract);language model(abstract);prompting(abstract)
Expressive Power of Implicit Models: Rich Equilibria and Test-Time Scaling
隐式模型的表达能力:丰富的均衡与测试时扩展
Jialin Liu, Lisang Ding, Stanley Osher, Wotao Yin
机构
*
University of Central Florida(中佛罗里达大学)
;
University of California, Los Angeles(加利福尼亚大学洛杉矶分校)
;
Decision Intelligence Lab, DAMO Academy, Alibaba US(达摩院决策智能实验室,阿里巴巴美国)
Yang Zhao, Chengxiao Dai, Wei Zhuo, Yue Xiu, Dusit Niyato
机构
*
Independent Researcher(独立研究员)
;
School of Computer Science, The University of Sydney, Australia(悉尼大学计算机科学学院)
;
College of Computing & Data Science, Nanyang Technological University, Singapore(南洋理工大学计算与数据科学学院)