机构
*
Tsinghua University(清华大学)
;
Chongqing University(重庆大学)
;
Peking University(北京大学)
;
ZenoMind AI
;
Xi’an Jiaotong University(西安交通大学)
;
Beijing Institute of Technology(北京理工大学)
;
Southeast University(东南大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Joy Future Academy(京东探索研究院)
;
The University of Hong Kong(香港大学)
Position: The Systemic Lack of Agency in Visual Reasoning
立场:视觉推理中系统性的能动性缺失
Yizhao Huang, Haoyang Chen, Shiqin Wang, Pohsun Huang, Jiayuan Li, Haoyuan Du, Yandong Shi, Zheng Wang, Zhixiang Wang
机构
*
National Engineering Research Center for Multimedia Software, Institute of Artificial Intelligence, School of Computer Science, Wuhan University(武汉大学计算机学院人工智能研究所多媒体软件工程研究中心)
;
Hubei Key Laboratory of Multimedia(湖北省多媒体与网络通信工程重点实验室)
;
Zhongguancun Academy, Beijing, China. 100094(中关村学院,北京,中国)
;
School of Automation, Beijing Institute of Technology(北京理工大学自动化学院)
;
Shanda AI Research Tokyo(上海大势人工智能研究东京)
Reasoning in Computer Vision: Taxonomy, Models, Tasks, and Methodologies
计算机视觉中的推理:分类、模型、任务与方法论
Ayushman Sarkar, Zhenyu Yu, Mohd Yamani Idna Idris
机构
*
Department of Computer Science and Engineering, Birbhum Institute of Engineering and Technology(计算机科学与工程系,比罗尔理工学院)
;
College of Computer Science and Artificial Intelligence, Fudan University(计算机科学与人工智能学院,复旦大学)
;
Faculty of Computer Science and Information Technology, Universiti Malaya(计算机科学与信息技术学院,马来亚大学)
OmniTraffic: A Controllable Generation Pipeline and Benchmark for Spatio-Temporal Traffic Reasoning
OmniTraffic:面向时空交通推理的可控生成流水线与基准
Maonan Wang, Zhengyan Huang, Kemou Jiang, Yuhang Fu, Jiayue Zhu, Yuxin Cai, Xingchen Zou, Qiaosheng Zhang, Yi Yu, Ding Wang, Xi Chen, Ben M. Chen, Yuxuan Liang, Zhiyong Cui, Man On Pun, Yirong Chen
机构
*
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Shanghai AI Lab(上海人工智能实验室)
;
Beihang University(北京航空航天大学)
;
Nanyang Technological University(南洋理工大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
The Chinese University of Hong Kong(香港中文大学)
CommentsPublished at the IEEE ICRA 2026 Xplore Workshop (Oral), Cross-Disciplinary aspects of Exploration in Robotics, Reinforcement Learning, and Search
Human-Enhanced Loop Modeling (HELM): Agent-Based Finite Element Modeling of Concrete Bridge Barriers
人类增强循环建模(HELM):基于智能体的混凝土桥梁护栏有限元建模
Quankai Wang, Yulin Xie, Tongfei Yang, Minghui Cheng, Ran Cao
机构
*
College of Civil Engineering, Hunan University(湖南大学土木工程学院)
;
Department of Civil and Architectural Engineering, University of Miami(迈阿密大学土木与建筑系)
;
School of Architecture, University of Miami(迈阿密大学建筑学院)
Object Tokens as a Bridge Between Segmentation and Visual Question Answering in Robotic Surgery
对象标记作为机器人手术中分割与视觉问答的桥梁
Yiping Li, Ronald de Jong, Romy van Jaarsveld, Franco Badaloni, Gino Kuiper, Jelle Ruurda, Josien Pluim, Marcel Breeuwer
机构
*
Department of Biomedical Engineering, Eindhoven University of Technology(埃因霍温理工大学生物医学工程系)
;
Department of Electrical Engineering, Eindhoven University of Technology(埃因霍温理工大学电气工程系)
;
Department of Surgery, University Medical Center Utrecht(乌得勒支大学医学中心外科)
WAM-Nav: Asymmetric Latent World-Action Modeling for Unified Visual Navigation
WAM-Nav:面向统一视觉导航的非对称潜在世界-动作建模
Ning Yang, Yan Huang, Kaiwen Peng, Ziheng He, Kai Wang, Cui Miao, Kailin Lyu, Guo Li, Xiaofeng Wang, Zheng Zhu, Jing Liu, Nianfeng Liu
机构
*
Nanjing University(南京大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
FiveAges
;
National University of Defense Technology(国防科技大学)
;
Tsinghua University(清华大学)
;
GigaAI