机构
*
City University of Hong Kong
;
Tencent
;
Institute of Artificial Intelligence (TeleAI), China Telecom
;
Institute of Automation, Chinese Academy of Sciences. Corresponding Author
JT-SAFE-V2: Safety-by-Design Foundation Model with World-Context Data
JT-SAFE-V2:具有世界上下文数据的安全设计基础模型
Junlan Feng, Fanyu Meng, Chong Long, Pengyu Cong, Duqing Wang, Yan Zheng, Yuyao Zhang, Xuanchang Gao, Ye Yuan, Yunfei Ma, Zhijie Ren, Fan Yang, Na Wu, Di Jin, Chao Deng
The A-R Behavioral Space: Execution-Level Profiling of Tool-Using Language Model Agents in Organizational Deployment
A-R行为空间:组织部署中工具使用语言模型代理的执行层剖析
Shasha Yu, Fiona Carroll, Barry L. Bentley
机构
*
Cardiff School of Technologies, Cardiff Metropolitan University(卡迪夫技术学院,卡迪夫市政大学)
;
School of Professional Studies, Clark University(专业研究学院,克拉克大学)
;
Harvard Medical School, Harvard University(哈佛医学院,哈佛大学)
IVR-R1: Refining Trajectories through Iterative Visual-Grounded Reasoning in Reinforcement Learning
IVR-R1:通过强化学习中的迭代视觉基础推理优化轨迹
Chenghao Li, Fusheng Hao, Xikai Zhang, Likang Xiao, Yanwei Ren, Fuxiang Wu, Quan Chen, Liu Liu
机构
*
Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院)
;
School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院)
;
Kuaishou Technology(快手科技)
;
Shenzhen Institute of Advanced Integration Technology, Shenzhen(深圳先进集成技术研究院)
CRPO: Character-centric Group Relative Policy Optimization for Role-aware Reasoning in Role-playing Agents
CRPO:以角色为中心的群体相对策略优化用于角色扮演代理中的角色感知推理
Yihong Tang, Kehai Chen, Liang Yue, Benyou Wang, Min Zhang
机构
*
Institute of Computing and Intelligence(计算与智能研究院)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Shenzhen Loop Area Institute (SLAI)(深圳Loop区研究院)
;
The Chinese University of Hong Kong(香港中文大学)
AEROS: A Single-Agent Operating Architecture with Embodied Capability Modules
AEROS:一种具有具身能力模块的单智能体操作架构
Xue Qin, Simin Luan, John See, Cong Yang, Zhijun Li
机构
*
School of Software, Harbin Institute of Technology(哈尔滨工业大学软件学院)
;
School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院)
;
School of Mathematical and Computer Sciences, Heriot-Watt University, Malaysia Campus(赫瑞-沃森大学马来西亚分校数学与计算机科学学院)
;
School of Future Science and Engineering, Soochow University(苏州大学未来科学与工程学院)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
The Chinese University of Hong Kong(香港中文大学)
;
Xiaohongshu Inc.(小红书公司)
Safety in Embodied AI: A Survey of Risks, Attacks, and Defenses
具身人工智能的安全性:风险、攻击与防御综述
Xiao Li, Xiang Zheng, Yifeng Gao, Xinyu Xia, Yixu Wang, Xin Wang, Ye Sun, Yunhan Zhao, Ming Wen, Jiayu Li, Zixing Chen, Xun Gong, Yi Liu, Yige Li, Yutao Wu, Cong Wang, Jun Sun, Yixin Cao, Zhineng Chen, Jingjing Chen, Tao Gui, Qi Zhang, Zuxuan Wu, Xipeng Qiu, Xuanjing Huang, Tiehua Zhang, Zhipeng Wei, Kun Wang, Xinfeng Li, Hanxun Huang, Sarah Erfani, James Bailey, Jianping Wang, Chaowei Xiao, Ran He, Bo Li, Xingjun Ma, Yu-Gang Jiang
机构
*
Fudan University(复旦大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
City University of Hong Kong(香港城市大学)
;
Jilin University(吉林大学)
;
Singapore Management University(新加坡管理大学)
;
Deakin University(德肯大学)
;
Tongji University(同济大学)
;
Nanyang Technological University(南洋理工大学)
;
Chinese Academy of Sciences(中国科学院)
;
The University of Melbourne(墨尔本大学)
;
Johns Hopkins University(约翰霍普金斯大学)
CommentsSurvey paper; 75 pages, 4 figures, 18 tables; v2 expands embodied-specific coverage of agentic threats, World Action Model threats, and contextual risk mitigation, with over 100 new references added. Project page: https://x-zheng16.github.io/Awesome-Embodied-AI-Safety/
StructBreak: Structural Cognitive Overload-Induced Safety Failures in MLLMs
StructBreak: 多模态大语言模型中结构性认知过载引发的安全故障
Yang Luo, Xinran Liu, Tiantian Ji, Zhiyi Yin, Lingyun Peng, Shuyu Li
机构
*
Key Laboratory of Trustworthy Distributed Computing and Service (MoE), Beijing University of Posts and Telecommunications(可信分布式计算与服务重点实验室(MoE),北京邮电大学)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)