CyberGym-E2E: Scalable Real-World Benchmark for AI Agents' End-to-End Cybersecurity Capabilities
CyberGym-E2E:面向AI代理端到端网络安全能力的可扩展真实世界基准
Tianneng Shi, Robin Rheem, Dongwei Jiang, Mona Wang, Francisco De La Riega, Zhun Wang, Jingzhi Jiang, Alexander Cheung, Sean Tai, Jonah Cha, Jianhong Tu, Gabriel Han, Chenguang Wang, Jingxuan He, Wenbo Guo, Dawn Song
A Dual-Helix Governance Approach Towards Reliable Agentic Artificial Intelligence for WebGIS Development
面向可靠WebGIS开发的代理人工智能双螺旋治理方法
Boyuan Guan, Wencong Cui, Levente Juhasz
机构
*
Geographic Information Systems Center, Florida International University(佛罗里达国际大学地理信息系统中心)
;
Geospatial Analytics, Technology and Open Research Lab, University of Florida(佛罗里达大学地理空间分析、技术与开放研究实验室)
SubtleMemory: A Benchmark for Fine-Grained Relational Memory Discrimination in Long-Horizon AI Agents
SubtleMemory: 面向长时程AI智能体的细粒度关系记忆辨别基准
Wenxuan Wang, Haoyu Sun, Fukuan Hou, Mingyang Song, Weinan Zhang, Yu Cheng, Yang Yang
机构
*
Harbin Institute of Technology(哈尔滨工业大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Tongji University(同济大学)
;
Xiamen University(厦门大学)
;
Fudan University(复旦大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
The Chinese University of Hong Kong(香港中文大学)
ComBodied Agents: a New Paradigm of Human-Centric Agentic AI
具身融合智能体:以人为中心的智能体人工智能新范式
Qianggang Ding, Xingyao Wang, Rui Feng, Zhibin Wang, Feixiang Yao, Kelong Mao, Hao Sun, Zhiyao Luo, Jiankai Tang, Lei Li, Jiadong Guo, Minheng Ni, Weicong Lin, Chenxi Yang, Hongxiang Gao, Zhenghua Chen, Yang Bai, Min Wu, Jun Cheng, Huazhu Fu, Dacheng Tao, Bang Liu
机构
*
Université de Montréal(蒙特利尔大学)
;
Mila – Quebec Artificial Intelligence Institute(米拉-魁北克人工智能研究所)
;
Institute of Advanced Intelligence and Computing (IAIC), A*STAR(新加坡科技研究局高级智能与计算研究所)
;
Nanjing Medical University(南京医科大学)
;
Nanjing University(南京大学)
;
Renmin University of China(中国人民大学)
;
University of Cambridge(剑桥大学)
;
University of Oxford(牛津大学)
;
Tsinghua University(清华大学)
;
National University of Singapore(新加坡国立大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
;
The Hong Kong Polytechnic University(香港理工大学)
;
Southern University of Science and Technology(南方科技大学)
;
Southeast University(东南大学)
;
University of Glasgow(格拉斯哥大学)
;
Nanyang Technological University(南洋理工大学)
Designing Agentic AI-Based Screening for Portfolio Investment
基于代理AI的资产组合投资筛选设计
Mehmet Caner, Agostino Capponi, Nathan Sun, Jonathan Y. Tan
机构
*
North Carolina State University, Nelson Hall, Department of Economics(北卡罗来纳州立大学,Nelson Hall,经济学系)
;
Columbia University. Department of Industrial Engineering and Operations Research and Columbia Business School(哥伦比亚大学,工业工程与运筹学系及哥伦比亚商学院)
;
Columbia University. Department of Industrial Engineering and Operations Research(哥伦比亚大学,工业工程与运筹学系)
AIVV: Neuro-Symbolic LLM Agent-Integrated Verification and Validation for Trustworthy Autonomous Systems
AIVV: 用于可信自主系统的神经符号LLM代理集成验证与验证
Jiyong Kwon, Ujin Jeon, Sooji Lee, Guang Lin
机构
*
School of Mechanical Engineering, Purdue University(普渡大学机械工程学院)
;
School of Electrical and Computer Engineering, Purdue University(普渡大学电气与计算机工程学院)
;
Department of Computer Science, Purdue University(普渡大学计算机科学系)
;
Department of Mathematics, Purdue University(普渡大学数学系)
What If Prompt Injection Never Left? Rethinking Agent Security through Cross-Session Stored Prompt Injection
如果提示注入从未消失?探索智能体系统中的跨会话存储提示注入
Yuanbo Xie, Wenlei Zhu, Tianyun Liu, Yingjie Zhang, Suchen Liu, Yulin Li, Liya Su, Tingwen Liu
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)
;
AI Sec Lab, Beijing Chaitin Technology Co.,Ltd(北京柴坦科技有限公司AI安全实验室)
CommentsAccepted at the Second Workshop on Agents in the Wild: Safety, Security, and Beyond (AIWILD), ICML 2026. Revised to match the camera-ready version. OpenReview: https://openreview.net/forum?id=aUSUvS4dPL