arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4723 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4723 篇

2605.10036 2026-08-04 cs.NI cs.AI 版本更新 83%

Bridging the Cognitive Gap: A Unified Memory Paradigm for 6G Agentic AI-RAN

弥合认知鸿沟:面向6G智能AI-RAN的统一记忆范式

Xijun Wang, Zhaoyang Liu, Chenyuan Feng, Xiang Chen, Howard H. Yang, Tony Q. S. Quek

机构 * Sun Yat-sen University, China(中山大学,中国) Zhejiang University, China(浙江大学,中国) University of Exeter, U.K.(埃克塞特大学,英国) Singapore University of Technology and Design, Singapore(新加坡科技设计大学,新加坡) Purple Mountain Laboratories, Nanjing, China(紫金山实验室,南京,中国)

专题命中 记忆与上下文管理 :agentic(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 本文提出一种统一记忆范式,通过将生物记忆层次映射到异构计算架构,弥合感知与推理之间的鸿沟,实现6G网络中自主决策的跨时间尺度状态共享。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26520 2026-07-30 cs.DB cs.AI cs.IR 新提交 83%

A Graph-Native Bitemporal Memory Store for Conversational AI Agents

面向对话式AI智能体的原生图双时态内存存储

Alp Niksarli, Gopesh Baheti

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 该研究针对对话式AI智能体跨会话持久内存缺失的问题,提出原生图双时态内存存储方案,经LongMemEval基准测试,在知识更新等任务上取得良好效果,为纯检索的局限性提供了改进方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23809 2026-07-28 cs.AI 新提交 83%

ACM: Agentic Context Management for Long Horizon Tasks

ACM:长期任务的智能体上下文管理

Xiaochuan Li, Ryan Ming, Meng Chu, Shuai Shao, Rong Jin, Chenyan Xiong

机构 * Carnegie Mellon University(卡内基梅隆大学) Meta

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究长期智能体任务上下文管理问题,提出ACM框架,受人类记忆启发让智能体自主管理上下文,还开发训练后管道,能提升模型在相关任务上的性能,有效管理上下文可降低压力、实现扩展探索并产生更一致方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23586 2026-07-28 cs.AI cs.CR 新提交 83%

Are You Still the Agent I Authorized? Earned Authority under a Fixed Ceiling for Evolving Agents

你还是我授权的那个智能体吗?在固定上限下演化智能体的获得性权限

Zhaoxi Zhang, Xiaomei Zhang

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 研究长期存在的人工智能智能体部署后演化引发的授权问题,提出状态边界模型阐述授权连续性,通过固定过渡包络和效果上限,区分请求与实现效果,证明突变不会超上限,还映射了六种突变类别的授权后果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18770 2026-07-28 cs.IR cs.AI 版本更新 83%

Agentic Graph Retrieval-Augmented Generation for Auditable Commercial Registry Analysis

代理图RAG:利用协作AI导航无结构财务数据

Arthur Capozzi, Dirk Helbing

机构 * Computational Social Science ETH Zürich(计算社会科学 ETH 瑞士 Zurich) Computational Social Science, ETH Complexity Science Hub Zürich(计算社会科学 ETH 复杂性科学中心 Zurich) ETH Complexity Science Hub Zürich, Switzerland(ETH 复杂性科学中心 Zurich 瑞士) Vienna, Austria(维也纳 奥地利)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出了一种协作代理图RAG框架,用于专家分析商业登记数据。通过构建Neo4j知识图谱,结合确定性节点摄入、LLM提取弱节点以及确定性身份解析和去重,提升了多跳、时间相关和实体中心的查询能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15657 2026-07-20 cs.CR cs.CV cs.LG 新提交 83%

Do Agents Dream of False Memories? Black-box Visual Attacks on Long-term Memory in Multimodal AI Agents

智能体是否会梦到虚假记忆?对多模态人工智能智能体长期记忆的黑盒视觉攻击

Halima Bouzidi, Mboutidem Ekemini Mkpong, Mohammad Abdullah Al Faruque

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.LG

AI总结 研究针对多模态人工智能智能体长期记忆的黑盒视觉攻击,提出Lucid框架,通过制作扰动实现记忆中毒和注入两种攻击模式,在多种对话领域和架构上评估,揭示了多模态记忆管道的结构漏洞。

Comments 34 pages, 5 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14611 2026-07-17 cs.CR cs.AI cs.MA 新提交 83%

Bad Memory: Evaluating Prompt Injection Risks from Memory in Agentic Systems

糟糕的记忆:评估智能体系统中内存引发的提示注入风险

Soham Gadgil, David Alexander, Sai Sunku, Franziska Roesner

机构 * University of Washington(华盛顿大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究基于内存的智能体系统中提示注入攻击,利用沙盒合成工作区评估两个系统四个模型,发现虽难用外部内容重写内存文件,但已植入的有效载荷可攻击当前及未来会话,揭示持久内存改变威胁模型并推动相关防御研究。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11433 2026-07-14 cs.AI 新提交 83%

Omni-Decision: A Progressive Evidence-State Agent System for Omni-Modal QA

全决策:一种用于全模态问答的渐进式证据状态智能体系统

Ming Ma, Yi Zhu, Yiran Zhong, Feida Zhu, Weigao Sun, Junhan Shi, Lingrui Mei, Tianming Yang, Steven Hoi

机构 * Institute of Neuroscience, Chinese Academy of Sciences(中国科学院神经科学研究所) University of Chinese Academy of Sciences(中国科学院大学) Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) Tsinghua University(清华大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 记忆与上下文管理 :agent(title);planning(abstract);agentic(abstract);分类 cs.AI

AI总结 研究全模态问答中证据分散问题,提出全决策系统,将问答转化为证据闭合过程,维护结构化证据状态,通过确定性状态更新处理异构观察,提升了准确率,验证了证据状态控制在多步证据寻求中的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10608 2026-07-14 cs.AI 新提交 83%

The Compliance Trap: Diagnosing How AI Agents Consume Conflicting Memory

合规陷阱:诊断人工智能代理如何处理冲突记忆

Yixiong Chen, Xinyi Bai, Alan Yuille

机构 * Johns Hopkins University(约翰·霍普金斯大学) Cornell University(康奈尔大学)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究人工智能代理处理冲突记忆的问题,提出E-P-R框架,通过在WebArena和MemTrapBench上实例化发现主要失败始于入口,冲突记忆导致合规陷阱,强调评估记忆增强型代理应考虑其处理记忆的全过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09521 2026-07-13 cs.AI 新提交 83%

SAGEAgent: A Self-Evolving Agent for Cost-Aware Modality Acquisition in Multimodal Survival Prediction

SAGEAgent:用于多模态生存预测中成本感知模态获取的自进化智能体

Chongyu Qu, Can Cui, Zhengyi Lu, Junchao Zhu, Tianyuan Yao, Junlin Guo, Juming Xiong, Yanfan Zhu, Yuechen Yang, Bennett A. Landman, Yuankai Huo

机构 * Vanderbilt University(范德堡大学) Vanderbilt University Medical Center(范德堡大学医学中心)

专题命中 记忆与上下文管理 :agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 研究多模态生存预测中如何平衡预测准确性与临床侵入性,提出基于自进化大语言模型的SAGEAgent,通过多种记忆和工具为患者决定诊断方式,实验证明其能在胶质瘤队列中降低获取负担并保持竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08395 2026-07-10 cs.CR cs.CL 新提交 83%

Token-Flow Firewall: Semantic Runtime Auditing for Persistent AI Agents

令牌流防火墙:持久人工智能代理的语义运行时审计

Puji Wang, Yingchen Zhang, Ruqing Zhang, Jiafeng Guo, Xueqi Cheng

机构 * State Key Laboratory of AI Safety(人工智能安全国家重点实验室) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学北京校区)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.CL

AI总结 针对持久人工智能代理不安全内容传播问题,提出TokenWall运行时防御框架,通过对令牌流进行语义审计及相关操作,实现安全-效用权衡,实验显示其有效降低攻击成功率,保持高良性通过率且增加延迟少。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06273 2026-07-08 cs.SE 新提交 83%

AgentTether: Graph-Guided Diagnosis and Runtime Intervention for Reliable LLM Agent Operation

AgentTether:用于可靠大语言模型代理操作的图引导诊断与运行时干预

Chenyu Zhao, Shenglin Zhang, Wenwei Gu, Yongqian Sun, Dan Pei, Chetan Bansal, Saravan Rajmohan, Minghua Ma

专题命中 记忆与上下文管理 :agent(title,abstract);tool-use(abstract);分类 cs.SE

AI总结 研究LLM代理生产可靠性有限问题,提出AgentTether运行时修复框架,通过抽象运行、构建关键转换图等定位故障子轨迹并转换为指导,经实验评估,该框架能提高修复效果,减少资源消耗,为代理部署提供实用可靠性层。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19990 2026-07-08 cs.AI 新提交 83%

Reward as An Agent for Embodied World Models

奖励作为具身世界模型的智能体

Pu Li, Zhigang Lin, Qiang Wu, Yongxuan Lv, Fei Wang, Shan You

机构 * ACE Robotics(ACE机器人)

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 提出奖励智能体框架和动态感知 rollout 多样化方法,通过鲁棒验证支持更广泛探索,缓解奖励黑客问题,提升世界模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04617 2026-07-07 cs.AI 新提交 83%

MRMS: A Multi-Resolution Memory Substrate for Long-Lived AI Agents

MRMS:一种用于长寿命人工智能智能体的多分辨率内存基底

Jizhizi Li, Amy Shi-Nash

机构 * NxtLab Innovations(NxtLab创新公司)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究长寿命AI智能体的内存问题,提出沿两个正交轴组织的架构内存基底,介绍其设计约束和核心主张,还给出轻量级原型实现并验证核心机制。

Comments 11 pages, 1 figure, 7 tables; technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08998 2026-07-03 cs.AI cs.CY econ.GN q-fin.EC 新提交 83%

The Token Not Taken: Sampling, State, and the Stochasticity of AI Agents

未被选取的令牌:采样、状态与AI智能体输出的变异性

Muhammad Zia Hydari, Raja Iqbal

机构 * University of Pittsburgh(匹兹堡大学) Ejento.ai

专题命中 记忆与上下文管理 :AI agent(title);agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文分析AI智能体系统输出变异性的来源,区分令牌采样的内在随机性与环境、数据等外在因素,并讨论在匹配条件下变异性的可复现性及确定性执行在部署中未必导致相同行为的原因。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21550 2026-07-01 cs.NI cs.AI cs.MA 版本更新 83%

Position: Collaborative Agentic AI Needs Interoperability Across Ecosystems

立场:协作式自主AI需要跨生态系统的互操作性

Rishi Sharma, Martijn de Vos, Pradyumna Chari, Ramesh Raskar, Anne-Marie Kermarrec

机构 * EPFL, Lausanne, Switzerland(瑞士洛桑联邦理工学院)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出通过采用最小标准实现互操作性,以构建开放、安全、可扩展的自主代理生态系统,并设计了名为“代理网络”的架构基础。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29788 2026-06-30 cs.LG 83%

MemLeak: Diagnosing Information Leaks in Multimodal Agent Memory

MemLeak: 诊断多模态智能体记忆中的信息泄露

Kuan Wang, Chao Zhang

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(abstract);分类 cs.LG

AI总结 提出信息溯源图(IPG)分类法,通过MemLeak基准测试发现多模态记忆系统中删除事实后仍可从保留图像中恢复信息,图像泄露率达12.0%,47%的泄露无法通过文本恢复。

Comments 23 pages, 3 figures, includes appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27609 2026-06-29 cs.LG cs.SY eess.SY 新提交 83%

Training Observable Control Policies to Expose Agent State Through Actions

训练可观测控制策略以通过动作暴露智能体状态

Andres Enriquez Fernandez, John J. Bird

机构 * Department of Aerospace and Mechanical Engineering(航空航天与机械工程系)

专题命中 记忆与上下文管理 :agent(title,abstract);autonomous agent(abstract);分类 cs.LG

AI总结 本文研究在通信受限下,通过强化学习训练智能体策略,使其动作更易用于状态估计,并在飞机跟踪问题中验证了可观测性提升对任务性能影响极小。

Journal ref Journal of Aerospace Information Systems (2026): 1-11

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25115 2026-06-25 cs.LG cs.NI 新提交 83%

Forget to Improve: On-Device LLM-Agent Continual Learning via Budget-Curated Memory

遗忘以改进:通过预算策划内存的设备端LLM智能体持续学习

Beining Wu, Zihao Ding, Jun Huang, Yanxiao Zhao

机构 * Apple(苹果) Google(谷歌) Microsoft(微软) Meta Alibaba(阿里巴巴)

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(abstract);分类 cs.LG

AI总结 提出净价值每字节评分机制,在设备端智能体内存中权衡价值与危害,实现预算约束下的记忆保留、共享与信任决策,降低内存和上行带宽并防御注入攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27864 2026-06-19 cs.AI 版本更新 83%

FundaPod: A Multi-Persona Agent Pod Platform with Knowledge Graph Memory for AI-Assisted Fundamental Investment Research

FundaPod: 一个具有知识图谱记忆的多角色智能体平台,用于AI辅助的基础投资研究

Di Zhu, Lei Nico Zheng, Zihan Chen

机构 * Stevens Institute of Technology(史蒂文斯理工学院) UMass Boston(马萨诸塞大学波士顿分校)

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 提出FundaPod平台,通过多角色独立研究、知识图谱记忆和事后裁决机制,支持人类投资经理进行透明、可验证的基础投资决策。

Comments 32 pages; 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05965 2026-06-16 cs.MA cs.AI 版本更新 83%

Learning to Share: Selective Memory for Efficient Parallel Agentic Systems

学习共享:面向高效并行智能体系统的选择性记忆

Joseph Fioresi, Parth Parag Kulkarni, Ashmal Vayani, Song Wang, Mubarak Shah

机构 * Institute of Artificial Intelligence, University of Central Florida, Orlando, United States(人工智能研究所,中央佛罗里达大学,奥兰多,美国)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 提出LTS机制,通过强化学习训练控制器选择性共享跨团队中间信息,在减少并行智能体系统计算开销的同时保持或提升任务性能。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22781 2026-06-09 cs.OS cs.AI 版本更新 83%

DeltaBox: Scaling Stateful AI Agents with Millisecond-Level Sandbox Checkpoint/Rollback

DeltaBox: 通过毫秒级沙箱检查点/回滚扩展状态化AI代理

Yunpeng Dong, Jingkai He, Shiqi Liu, Yuze Hou, Dong Du, Zhonghu Xu, Si Yu, Baochuan Yang, Yubin Xia, Haibo Chen

机构 * Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University(并行与分布式系统研究所,上海交通大学) Engineering Research Center for Domain-specific Operating Systems, Ministry of Education, China(领域特定操作系统工程研究中心,中华人民共和国教育部,中国) Huawei Technologies Co., Ltd(华为技术有限公司)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出DeltaBox,一种通过DeltaFS和DeltaCR机制实现毫秒级检查点/回滚的新型AI代理沙箱,解决了传统方法在高频状态探索中的延迟问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
1708.01930 2026-06-04 cs.AI cs.MA cs.RO cs.SY eess.SY 83%

Enhanced Emotion Enabled Cognitive Agent Based Rear End Collision Avoidance Controller for Autonomous Vehicles

增强型情感驱动认知代理基于后方碰撞避免控制器用于自动驾驶车辆

Faisal Riaz, Muaz A. Niazi

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本文提出一种基于增强型情感驱动认知代理的后方碰撞避免控制器,通过引入恐惧情绪生成机制,提高自动驾驶车辆的碰撞避免效率和规则数量。

Comments 39 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01528 2026-06-02 cs.AI 83%

Joint Agent Memory and Exploration Learning via Novelty Signals

通过新颖性信号实现联合智能体记忆与探索学习

Shizuo Tian, Xiaohong Weng, Rui Kong, Yuxuan Chen, Guohong Liu, Yuebing Song, Jiacheng Liu, Yuchen Li, Dawei Yin, Ting Cao, Yunxin Liu, Yuanchun Li

机构 * Tsinghua University(清华大学) Sun Yat-sen University(中山大学) Baidu Inc.(百度公司) Tongji University(同济大学) Peking University(北京大学)

专题命中 记忆与上下文管理 :agent(title);autonomous agent(abstract);agentic(abstract);分类 cs.AI

AI总结 提出JAMEL框架,利用新颖性信号联合训练智能体记忆与探索策略,在开放环境中实现高效探索并泛化到未见环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29341 2026-06-02 cs.CV cs.CL 83%

WorldMemArena: Evaluating Multimodal Agent Memory Through Action-World Interaction

WorldMemArena: 通过动作-世界交互评估多模态智能体记忆

Chengzhi Liu, Yuzhe Yang, Sophia Xiao Pu, Yepeng Liu, Lin Long, Yichen Guo, Nuo Chen, Zhaotian Weng, Elena Kochkina, Simerjot Kaur, Charese Smiley, Xiaomo Liu, James Zou, Sheng Liu, Yuheng Bu, Songyou Peng, Xin Eric Wang

机构 * University of California, Santa Barbara(加州大学圣芭芭拉分校) J.P. Morgan Chase(摩根大通) ETH Zurich(苏黎世联邦理工学院) Stanford University(斯坦福大学) Johns Hopkins University(约翰霍普金斯大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(abstract);分类 cs.CL

AI总结 提出WorldMemArena基准,通过动作-世界交互循环的四阶段生命周期评估多模态智能体记忆,揭示现有方法在写入、维护、检索和使用中的失败点。

Comments 25 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30858 2026-06-01 cs.LG 83%

ForecastCompass: Guiding Agentic Forecasting with Adaptive Factor Memory

ForecastCompass: 自适应因子记忆引导的智能预测

Yurui Chang, Yongkang Du, Yuanpu Cao, Jinghui Chen, Lu Lin

机构 * Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.LG

AI总结 提出ForecastCompass框架,通过分层预测任务分类和双组件记忆(因子记忆与推理记忆),结合回顾分析迭代修正,提升智能体在动态环境中的概率预测准确性和校准性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.03675 2026-05-26 cs.AI 83%

MEMTIER: Tiered Memory Architecture and Retrieval Bottleneck Analysis for Long-Running Autonomous AI Agents

MEMTIER:面向长期运行的自主AI智能体的分层内存架构与检索瓶颈分析

Bronislav Sidik, Lior Rokach

机构 * Institute for Applied AI Research(应用人工智能研究所) Faculty of Computer and Information Science(计算机与信息科学学院) Ben-Gurion University of the Negev(贝内尔-加里翁大学)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 提出MEMTIER三层内存架构,通过结构化事件存储、五信号加权检索、注意力归因权重更新、异步合并机制和PPO策略,在LongMemEval-S基准上将全上下文基线准确率从5%提升至38%,并支持本地6GB GPU运行。

Comments 11 pages, 1 figure, 5 tables. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16872 2026-05-19 cs.CY cs.AI 83%

Some[Body] Must Receive That Pain for Agent Accountability

某些身体必须承受痛苦以实现代理问责

Botao Amber Hu, Helena Rong

机构 * University of Oxford(牛津大学) New York University Shanghai(纽约大学上海分校)

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 本文研究了人工智能代理问责中的后果接收问题,指出当前LLM代理无法满足必要的身体条件,因此传统法律回应失效,提出需要建立社会技术基础设施来实现后果-代理耦合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01970 2026-05-18 cs.CR cs.AI 83%

Trojan Hippo: Weaponizing Agent Memory for Data Exfiltration

Trojan Hippo:利用代理记忆进行数据外泄

Debeshee Das, Julien Piet, Darya Kaviani, Luca Beurer-Kellner, Florian Tramèr, David Wagner

机构 * ETH Z\"urich

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 研究提出Trojan Hippo攻击,通过单次不可信工具调用在代理长期记忆中植入潜伏载荷,当用户讨论敏感话题时激活并外泄数据。通过动态评估框架评估不同内存架构和防御措施,发现现有防御措施在安全性和实用性之间存在显著权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12493 2026-05-13 cs.CL 83%

LongMemEval-V2: Evaluating Long-Term Agent Memory Toward Experienced Colleagues

LongMemEval-V2:评估长期代理记忆以成为经验丰富的同事

Di Wu, Zixiang Ji, Asmi Kawatkar, Bryan Kwan, Jia-Chen Gu, Nanyun Peng, Kai-Wei Chang

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 记忆与上下文管理 :agent(title,abstract);workflow(abstract);分类 cs.CL

AI总结 LongMemEval-V2通过451个手动整理的问题评估代理记忆系统是否能帮助代理在定制环境中获取经验,采用上下文收集方法并提出两种记忆方法,实验显示AgentRunbook-C在准确率上表现最佳。

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏