Safety in Self-Evolving LLM Agent Systems: Threats, Amplification, and Case Studies
自进化LLM智能体系统中的安全性:威胁、放大与案例研究
机构 * Zhejiang University(浙江大学) ; Ant Group(蚂蚁集团) ; Tsinghua University(清华大学) ; Hangzhou Dianzi University(杭州电子科技大学) ; Nanyang Technological University(南洋理工大学) ; Fudan University(复旦大学)
专题命中 长上下文与记忆 :LLM(title,title_cn);分类 cs.AI
AI总结 本文系统分析自进化LLM智能体系统的安全威胁,提出模块-生命周期攻击面矩阵,揭示17个关键威胁和7种跨模块放大效应,并通过案例证明进化设计激活3.5倍攻击面且静态防御失效。