Agent-X: Evaluating Deep Multimodal Reasoning in Vision-Centric Agentic Tasks
Agent-X:评估视觉中心智能体任务中的深度多模态推理
Tajamul Ashraf, Amal Saqib, Hanan Ghani, Muhra AlMahri, Yuhao Li, Noor Ahsan, Umair Nawaz, Jean Lahoud, Hisham Cholakkal, Mubarak Shah, Philip Torr, Fahad Shahbaz Khan, Rao Muhammad Anwer, Salman Khan
机构
*
Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学)
;
University of Central Florida(中央佛罗里达大学)
;
University of Oxford(牛津大学)
机构
*
Faculty of Engineering, Department of Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学工程学院、计算机科学与工程系)
;
Artificial Intelligence Innovation and Incubation Institute, Fudan University(复旦大学人工智能创新与孵化院)
;
Shanghai Academy of AI for Science(上海人工智能科学研究院)
AEROS: A Single-Agent Operating Architecture with Embodied Capability Modules
AEROS:一种具有具身能力模块的单智能体操作架构
Xue Qin, Simin Luan, John See, Cong Yang, Zhijun Li
机构
*
School of Software, Harbin Institute of Technology(哈尔滨工业大学软件学院)
;
School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院)
;
School of Mathematical and Computer Sciences, Heriot-Watt University, Malaysia Campus(赫瑞-沃森大学马来西亚分校数学与计算机科学学院)
;
School of Future Science and Engineering, Soochow University(苏州大学未来科学与工程学院)
Why We Need World Models for AGI: Where LLMs Fail and How World Models May Outperform
为什么我们需要世界模型来实现通用人工智能:大语言模型失败之处以及世界模型如何可能超越
Feisal Alaswad, Batoul Aljaddouh, Maher Alrahhal, Poovammal E, Talal Bonny
机构
*
Department of Computing Technologies(计算技术系)
;
SRM Institute of Science and Technology(SRM科学与技术学院)
;
Bio-Sensing and Bio-Sensors Group(生物传感与生物传感器组)
;
Smart Automation and Communication Technologies Research Institute of Sciences and Engineering(科学与工程智能自动化与通信技术研究所)
;
University of Sharjah, UAE(阿联酋沙迦大学)
;
Department of Computer Engineering(计算机工程系)
;
College of Computing and Informatics(计算与信息学院)
Safety in Embodied AI: A Survey of Risks, Attacks, and Defenses
具身人工智能的安全性:风险、攻击与防御综述
Xiao Li, Xiang Zheng, Yifeng Gao, Xinyu Xia, Yixu Wang, Xin Wang, Ye Sun, Yunhan Zhao, Ming Wen, Jiayu Li, Zixing Chen, Xun Gong, Yi Liu, Yige Li, Yutao Wu, Cong Wang, Jun Sun, Yixin Cao, Zhineng Chen, Jingjing Chen, Tao Gui, Qi Zhang, Zuxuan Wu, Xipeng Qiu, Xuanjing Huang, Tiehua Zhang, Zhipeng Wei, Kun Wang, Xinfeng Li, Hanxun Huang, Sarah Erfani, James Bailey, Jianping Wang, Chaowei Xiao, Ran He, Bo Li, Xingjun Ma, Yu-Gang Jiang
机构
*
Fudan University(复旦大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
City University of Hong Kong(香港城市大学)
;
Jilin University(吉林大学)
;
Singapore Management University(新加坡管理大学)
;
Deakin University(德肯大学)
;
Tongji University(同济大学)
;
Nanyang Technological University(南洋理工大学)
;
Chinese Academy of Sciences(中国科学院)
;
The University of Melbourne(墨尔本大学)
;
Johns Hopkins University(约翰霍普金斯大学)
CommentsSurvey paper; 75 pages, 4 figures, 18 tables; v2 expands embodied-specific coverage of agentic threats, World Action Model threats, and contextual risk mitigation, with over 100 new references added. Project page: https://x-zheng16.github.io/Awesome-Embodied-AI-Safety/
G-DRAGON: Geospatial Reasoning and Dynamic Planning for Retrieval-Augmented Outdoor Navigation
G-DRAGON:面向检索增强的户外导航的地理空间推理与动态规划
Dongzhihan Wang, Yi Du, Jianan Sun, Yuan Xue, Yingchen Zhang, Bing Xiao, Chen Wang, Liang Xu
机构
*
Spatial AI & Robotics Lab(空间人工智能与机器人实验室)
;
University at Buffalo(布法罗大学)
;
School of Future Technology(未来技术学院)
;
Shanghai University(上海大学)
;
University of Chinese Academy of Sciences(中国科学院大学)