FragFuse: Bypassing Access Control of Large Language Model Agents via Memory-Based Query Fragmentation and Fusion
FragFuse:通过基于记忆的查询碎片化与融合绕过大型语言模型智能体的访问控制
机构 * University of Georgia(佐治亚大学) ; University of Chicago(芝加哥大学) ; University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
专题命中 长上下文与记忆 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI
AI总结 提出FragFuse攻击,利用LLM智能体的长期记忆机制,将违禁内容碎片化存储后融合重构,绕过访问控制,平均绕过成功率达86.3%。
Comments 33 pages, 4 figures. Accepted by USENIX Security 2026