VGI-BENCH: Probing Visual Intelligence in Video Generation Models
VGI-BENCH:探究视频生成模型的视觉智能
Xuan He, Cong Wei, Yuhao Cheng, Linrui Ma, Yuxuan Zhang, Zuojun Li, Yuhao Wen, Zeyi Liu, Yuren Hao, Songcheng Cai, Keming Wu, Penghui Du, Kai Zou, Rui Yang, Chenkai Sun, Ke Yang, Ping Nie, Kelsey R Allen, Chenglong Wang, Michel Galley, Jianfeng Gao, ChengXiang Zhai
机构
*
University of Illinois Urbana Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Tsinghua University(清华大学)
;
University of Waterloo(滑铁卢大学)
;
Massachusetts Institute of Technology(麻省理工学院)
;
University of British Columbia(不列颠哥伦比亚大学)
;
Vector Institute(矢量研究所)
;
Microsoft Research(微软研究院)
;
Etude AI
Towards general embodied intelligence: integrating large language models, knowledge bases, and reasoning capabilities to build the next generation of AI agents
迈向通用具身智能:整合大语言模型、知识库与推理能力以构建下一代AI智能体
Fujiang Yuan, Xia Huang, Lusheng Wang, Jun Ding, Zhen Tian, Yuxin Wang, Shaojie Gu, Yuki Funabora, Yanhong Peng, Zebing Mao
机构
*
College of Mechanical Engineering, Chongqing University of Technology(重庆理工大学机械工程学院)
;
James Watt School of Engineering, University of Glasgow(格拉斯哥大学詹姆斯·瓦特工程学院)
;
School of Energy and Power, Jiangsu University of Science and Technology(江苏科技大学能源与动力学院)
;
Magnesium Research Center, Kumamoto University(熊本大学镁研究中心)
;
Department of Information and Communication Engineering, Nagoya University(名古屋大学信息与通信工程系)
;
State Key Laboratory of Fluid Power and Mechatronic Systems, Zhejiang University(浙江大学流体动力与机电系统国家重点实验室)
ID-VTG: Image-Disambiguated Video Temporal Grounding
ID-VTG:基于图像消歧的视频时间定位
Minghang Zheng, Jingli Wei, Hongyi Yang, Yang Liu
机构
*
Wangxuan Institute of Computer Technology, Peking University(北京大学王选计算机研究所)
;
State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室)
Planning-Oriented End-to-End Autonomous Driving: Architectures, Evaluation, and Emerging Paradigms
面向规划的端到端自动驾驶:架构、评估与新兴范式
Yanchen Guan, Xingcheng Liu, Bin Rao, Chengyue Wang, Guofa Li, Yunjian Li, Lishengsa Yue, Zhiyong Cui, Chengzhong Xu, Zhenning Li
机构
*
University of Macau(澳门大学)
;
Chongqing University(重庆大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
;
Tongji University(同济大学)
;
Beihang University(北京航空航天大学)
Bringing analytic rigor to agentic AI for science: The Brain Researcher platform for neuroimaging data analysis
为面向科学的智能体AI赋予分析严谨性:用于神经影像数据分析的Brain Researcher平台
Zijiao Chen, Nicholas Lu, Xinhui Li, Jocelyn A. Ricard, Ce Ju, Huan H. Wang, Christian Kindermann, Jeanette A. Mumford, Steven Dillmann, James Kent, Alejandro de la Vega, Sanmi Koyejo, Vince D. Calhoun, Joshua W. Buckholtz, Juan Helen Zhou, Steffen Bollmann, Russell A. Poldrack
机构
*
Stanford University(斯坦福大学)
;
Tri-institutional Center for Translational Research in Neuroimaging and Data Science (TReNDS)(三机构神经成像与数据科学转化研究中心(TReNDS))
;
Georgia State University(佐治亚州立大学)
;
Georgia Institute of Technology(佐治亚理工学院)
;
Emory University(埃默里大学)
;
Inria(法国国家信息与自动化研究所)
;
CEA(法国原子能和替代能源委员会)
;
Université(大学)
OrthoSkillVLA: Continual Skill Learning via Gradient-Informed Skill Subspace Adaptation
OrthoSkillVLA:通过梯度感知技能子空间自适应实现持续技能学习
Jiaqi Wang, Zhou Fang, Qiongfeng Shi, Yi Zhou
机构
*
School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院)
;
School of Electronic Science and Engineering, Southeast University(东南大学电子科学与工程学院)