Your Agent's Memories Are Not Its Own: Forged Reasoning Attacks on LLM Agent Memory and Defenses
你的智能体记忆并非其自身所有:针对大语言模型智能体记忆的伪造推理攻击及防御
机构 * The Pennsylvania State University(宾夕法尼亚州立大学)
专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 研究针对大语言模型智能体记忆伪造推理的攻击,提出FARMA攻击方法,通过规避语言伪造推理痕迹并强化,还引入SENTINEL防御管道,实验表明该防御能有效降低攻击成功率。
Comments Preprint. 10 pages, 2 figures, 4 tables