MemEvoBench: Benchmarking Safety Risks from Memory Misevolution in LLM Agents
MemEvoBench: 评估LLM代理中内存误进化带来的安全风险
机构 * Shanghai Jiao Tong University(上海交通大学) ; East China Normal University(华东师范大学) ; Shandong University(山东大学) ; Duke University(杜克大学)
专题命中 安全评测 :safety(title,abstract);分类 cs.CL
AI总结 本文提出MemEvoBench,首个评估LLM代理长期内存安全性的基准,针对对抗性内存注入、噪声工具输出和偏见反馈,通过7个领域36种风险类型的问题任务和20个Agent-SafetyBench环境改编的工作流任务,验证了内存进化对安全性的重大影响,指出静态提示防御不足,亟需加强LLM代理内存进化的安全性。