arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 6842 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 427 篇

2606.15903 2026-06-17 cs.CL cs.AI 新提交 81%

Control-Plane Placement Shapes Forgetting: An Architectural Study of Agent Memory Across Thirteen System Configurations

控制平面放置塑造遗忘:跨十三种系统配置的智能体记忆架构研究

Dongxu Yang

机构 * DeepLethe

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 研究LLM在智能体记忆管道中的位置(控制平面 vs 召回平面)对遗忘失败模式的影响,通过13种配置在385例对抗测试集上的实验,揭示了三种放置机制的互补覆盖范围,并提出了ForgetEval评估套件。

Comments 25 pages including appendices. Code, benchmark, and adapters released under MIT at https://github.com/deeplethe/lethe

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14211 2026-06-15 cs.AI cs.LG 新提交 81%

Closing the Reflection Gap: A Free Calibration Bonus for Agentic RL

缩小反思差距:面向智能体强化学习的免费校准奖励

Yinglun Zhu

机构 * University of California, Riverside(加州大学河滨分校)

专题命中 记忆与上下文管理 :agentic(title);agent(abstract);分类 cs.AI、cs.LG

AI总结 针对LLM智能体在环境反馈后自我评估不准确的问题,提出RefGRPO方法,通过对比反思与实际结果计算免费校准奖励并动态调整系数,同时提升反思校准和任务准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12703 2026-06-12 cs.CR cs.AI cs.LG 新提交 81%

SMSR: Certified Defence Against Runtime Memory Poisoning in Persistent LLM Agent Systems

SMSR:针对持久化LLM代理系统中运行时内存投毒的认证防御

Tarun Sharma

机构 * Independent Researcher(独立研究者)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 提出SMSR防御框架,通过写入时HMAC签名和查询时随机化内存消融与基于判决的多数投票,首次为多会话内存投毒攻击提供认证鲁棒性保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24775 2026-06-24 cs.CL cs.DB cs.IR 新提交 80%

Are We Ready For An Agent-Native Memory System?

我们准备好构建原生智能体记忆系统了吗?

Wei Zhou, Xuanhe Zhou, Shaokun Han, Hongming Xu, Guoliang Li, Zhiyu Li, Feiyu Xiong, Fan Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) MemTensor (Shanghai) Technology Co., Ltd(MemTensor(上海)科技有限公司)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 从数据管理视角系统研究智能体记忆,提出四模块分析框架,评估12种记忆系统,发现无单一架构占优,并揭示成本-性能权衡。

Comments Paper list available at: https://github.com/OpenDataBox/awesome-agent-memory. Source code available at: https://github.com/OpenDataBox/MemoryData

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09900 2026-06-10 cs.CL cs.AI cs.IR cs.LG 新提交 80%

Less Context, More Accuracy: A Bi-Temporal Memory Engine for LLM Agents Where a Lean Retrieved Context Beats the Full History

更少上下文,更高准确率:一种用于LLM Agent的双时间记忆引擎,其中精简检索上下文优于完整历史

Liuyin Wang

机构 * Independent Researcher(独立研究者)

专题命中 记忆与上下文管理 :agent(title_cn,abstract_cn);分类 cs.AI、cs.CL、cs.LG

AI总结 提出一种双时间记忆引擎Engram,通过混合读取路径从约9.6k token的检索片段中回答,在LongMemEval_S上达到83.6%准确率,比完整历史(79k token)高10.4个百分点,且无错误。

Comments 14 pages, 4 figures, 3 tables. Code, reproducible harness, and raw per-question logs: https://github.com/ly-wang19/engram

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18177 2026-08-20 cs.LG cs.MA 新提交 79%

Towards Reversible Forgetting: Managing Obsolete Knowledge in Continual Enterprise AI Agents

迈向可逆遗忘:在持续式企业智能体中管理过时知识

Nilutpaul Sarker Yash, Tirtho Roy, Ushashi Bhattacharjee

专题命中 记忆与上下文管理 :AI agent(title,abstract);分类 cs.LG

AI总结 针对企业AI智能体在非平稳环境中面临的过时知识问题,提出含三种记忆状态的可逆遗忘框架,实例化为滞后可逆记忆控制器,可减少过时信息影响且不混淆临时抑制与永久擦除,金融场景可验证其思路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17665 2026-08-19 cs.AI 新提交 79%

GraphWake: Group Polarization via Memory-Mediated Polarization Cascade in LLM-Agent Communities

GraphWake:LLM智能体社群中基于记忆介导极化级联的群体极化

Haoran Bu, Zejian Chen, Litian Zhang, Xi Zhang

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 该研究提出名为GraphWake的新型威胁,通过记忆介导极化级联操纵LLM智能体社群,实验证实其可大幅提升群体极化程度,揭示了社群层面的极化风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17148 2026-08-19 cs.CR cs.AI 新提交 79%

Authorization Before Context: A Model-Neutral Audience Boundary Against Cross-Audience Memory Leakage in Agentic Systems

上下文之前的授权:一种针对智能体系统中跨受众记忆泄露的模型无关受众边界

Sibo Liu

专题命中 记忆与上下文管理 :agentic(title);agent(abstract);分类 cs.AI

AI总结 本研究针对智能体系统的跨受众记忆泄露问题,提出模型无关的受众边界方法,通过反单调授权规则确保未授权事实不进入上下文,在合成数据集上验证了其有效性。

Comments 13 pages, 3 figures. Author preprint. Accepted for presentation at AdvML-Frontiers x CoTMA, a non-archival workshop at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15127 2026-08-18 cs.OS cs.AI cs.DC cs.MA 新提交 79%

From LLM Inference to Agentic Workloads: Characterization and Implications for Serving Systems

从大语言模型(LLM)推理到智能体工作负载:特征分析与服务系统启示

Chaokun Chang, Yukun Zhou, Kaihua Fu, Dakai An, Tianyu Feng, Hanfeng Lu, Sheng Yao, Pu Guo, Yinghao Yu, Yizhou Shan, Bo Li, Binhang Yuan, Wei Wang

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI

AI总结 本文提出AgentSysBench基准套件,分析智能体工作负载与传统LLM服务的6项差异,据此开展的4项设计探索可实现延迟降低、效率提升、内存减少及冗余调用节省等效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13833 2026-08-17 cs.IR cs.AI 新提交 79%

AdsWorldEngine: A Self-Evolving Conversational Advertising Agent through Orchestrator and Tool Coevolution

AdsWorldEngine:一种通过协调器与工具协同演化实现的自演进对话式广告智能体

Simiao Zuo, Chenhui Xu, Yimeng Jia, Qiang Lou, Jian Jiao, Denis Charles

专题命中 记忆与上下文管理 :agent(title);agentic(abstract);分类 cs.AI

AI总结 该研究提出AdsWorldEngine对话式广告框架,通过协调器与工具协同演化的自改进循环,结合机会门、评估器及基于标签的判断建模,在离线与在线实验中均显著提升广告性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12789 2026-08-14 cs.CR cs.AI 新提交 79%

PIPES: Securing Agent Perception with Provenance and Priors

PIPES:基于来源与先验的智能体感知安全防护方案

Sanjay Kariyappa, Severin Klingler, G. Edward Suh

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 该研究针对工具使用智能体感知易受状态篡改攻击的问题,提出PIPES防护方案,通过语义先验与来源筛选,大幅降低攻击成功率且保留良性效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12761 2026-08-14 cs.AI cs.CR 新提交 79%

Correct Is Not Governed: Provenance Integrity in Agentic Workflows

正确性不受管控:智能体工作流的来源完整性

Jesus Salas

机构 * Microsoft(微软公司)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI

AI总结 本文针对智能体工作流的来源完整性问题,提出确定性因果状态层Matrix作为机构完整性层,可记录依赖、验证证据,使工作可审计,且能限制恢复范围。

Comments 19 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12365 2026-08-14 cs.DB cs.AI 新提交 79%

FluctlightDB: A Memory Model of Data for AI Agents

FluctlightDB:面向AI智能体的数据内存模型

Ganesh S

专题命中 记忆与上下文管理 :AI agent(title);agent(abstract);分类 cs.AI

AI总结 本文提出面向AI智能体的独立数据内存模型,实现嵌入式引擎FluctlightDB,在多个记忆召回基准上取得优异结果,填补了数据栈的一层空白。

Comments 16 pages, 6 tables, 4 figures, appendix. Code and frozen benchmark artifacts: https://github.com/voxmastery/FluctlightDB. Preprint DOI: 10.5281/zenodo.20949890

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11654 2026-08-13 cs.LG 新提交 79%

Towards a Formal Definition of Agent Memory: Basis, Span, Optimality, and the Sequential Memory Problem

迈向智能体记忆的形式化定义:基础、跨度、最优性与序列记忆问题

Hongyao Tang

机构 * Tianjin University(天津大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.LG

AI总结 本文提出智能体记忆的形式化定义,定义最优记忆为容量受限的期望覆盖最大化器,实例化于《奥德赛》并将现有系统纳入框架,使记忆质量可度量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10689 2026-08-12 cs.HC cs.CL 新提交 79%

The Signal Rail: A Deterministic Motion Grammar for Communicating Conversational Agent State in Terminal Interfaces

信号轨:终端界面中用于传递对话智能体状态的确定性运动语法

Matteo Grella

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 Signal Rail为终端界面对话智能体设计确定性运动语法,通过空间语义等理念实现状态传递,完成规范与参考实现,提升非文本状态通道的信息表达能力。

Comments 16 pages, 3 figures. Ancillary files include the Signal Rail 1.0 specification, JavaScript and Python engines, and the cross-implementation conformance harness. Code: https://github.com/matteo-grella/signal-rail

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10402 2026-08-12 cs.LG cs.DC 新提交 79%

TideRL: Boosting Agentic RL Goodput with Readiness-Aware Scheduling

TideRL:通过就绪感知调度提升智能体强化学习的有效吞吐量

Yanyu Ren, Xizheng Wang, Xiao Liu, Bowen Lv, Hanchen Zhang, Shudan Zhang, Hanyu Lai, Shuai Wang, Li Chen, Dan Li, Jie Tang

机构 * Tsinghua University(清华大学) Zhongguancun Laboratory(中关村实验室)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.LG

AI总结 TideRL是一种就绪感知弹性RL系统,通过CTB、RA²P和ERS技术,在多轮智能体工作负载上大幅提升RL训练有效吞吐量,同时优化KV缓存命中率、训练时间和等待时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09184 2026-08-11 cs.AI 新提交 79%

Agentic Router: An Execution-Grounded Continual Learning Approach With Memory

智能体路由器:一种基于执行的带记忆的持续学习方法

Yuxuan Chen, Rongpeng Li, Zhifeng Zhao, Yuntao Liu, Xing Xu, Honggang Zhang

机构 * Zhejiang University(浙江大学) Zhejiang Lab(之江实验室) State Grid Hebei Electric Power Co., Ltd.(国网河北省电力有限公司) Macau University of Science and Technology(澳门科技大学)

专题命中 记忆与上下文管理 :agentic(title);agent(abstract);分类 cs.AI

AI总结 该研究针对CLI-based SONiC操作,提出基于执行的双路径后果感知智能体,通过生成动作、预测后果、重排序选择,提升可行动作覆盖度与执行成功率,两条路径互补增益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08612 2026-08-11 cs.CV cs.AI 新提交 79%

REVEAL: A Rubric-Guided Agent for Explicit Evidence Sufficiency Verificationin Long-Video Question Answering

REVEAL:用于长视频问答的基于 rubric(评分标准)的显式证据充分性验证智能体

Caijun Yan, Yang Zhou, Meixing Shi, Haoran Sun, Yichen Li, Yuxiang Cai, Yankai Jiang

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 该研究针对长视频问答中现有方法割裂事件、忽略证据充分性的问题,提出REVEAL框架,通过自适应分块的结构化记忆与rubric引导的证据验证,实现更可靠的推理且性能优于现有SOTA方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08131 2026-08-11 cs.CR cs.AI cs.MA 新提交 79%

Compositional Threat Analysis of Latent Compromise in LLM Agent Systems: The Order 66 Scenario

LLM智能体系统中潜在入侵的组合式威胁分析:66号指令场景

Satoshi Matsuoka

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本文以66号指令为场景,提出组合模型分析LLM智能体系统的潜在入侵威胁,分离三类传播路径,指出现有防御无法封闭所有路径,最强防御为能力调解等四项措施,暂未发现完整场景的公开观测。

Comments Version 11.3, 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06294 2026-08-07 cs.AI cs.ET 新提交 79%

QuanTiMedAI: Quantum-Enhanced Time-Series Model guided by Agentic AI for Cardiac Arrest Mortality Prediction

QuanTiMedAI:由智能体人工智能引导的量子增强时间序列模型用于心脏骤停死亡率预测

Mutasim Fuad Sarker, Adiba Rahman Namira, Wafa Binte Alam, Md Adnan Arefeen, Mahzabeen Emu, Sumaiya Tabassum Nimi

机构 * North South University(北南大学) Memorial University(纪念大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI

AI总结 该研究针对心脏骤停死亡率预测的静态数据局限,提出QuanTiMedAI量子-智能体框架,结合智能体LLM与量子循环网络,在MIMIC-IV数据集上仅用605个参数实现0.852的AUROC,优于现有最先进基线。

Comments Submitted for review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05906 2026-08-07 cs.CL 新提交 79%

Causal Episodic Memory for Feedback-Driven Agent Repair

用于反馈驱动智能体修复的因果情景记忆

Khang Nhat Hoang Vo, Tam Minh Chu, Anh Trac Duc Dinh, Thuyen Vinh Ha Bui, Tho Quan

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Faculty of Computer Science and Engineering, Ho Chi Minh City University of Technology (HCMUT), VNU-HCM(胡志明市理工大学计算机科学与工程学院(HCMUT,VNU-HCM))

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 本文提出无需训练的MERIT智能体,通过维护双极性记忆辅助LLM智能体修复,在Spider、BIRD数据集上提升了Text-to-SQL任务的执行准确率,同时明确了因果跨查询记忆的适用场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04746 2026-08-06 cs.CL cs.IR 新提交 79%

Caching for the Future: Scrub Jay Episodic Memory Principles for Agent Memory Systems

面向未来的缓存:用于智能体记忆系统的灌丛鸦情景记忆原理

Kartikey Singh Bhandari, Aarya Wadhwani, Dhruv Kumar, Pratik Narang

机构 * Birla Institute of Technology and Science, Pilani(比拉理工学院皮拉尼分校)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 该研究借鉴灌丛鸦情景记忆原理,提出ScrubJay-MEM智能体记忆系统,通过类型条件时间衰减优化记忆管理,在TGT和MemoryAgentBench任务上取得优于现有方法的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02843 2026-08-05 cs.CR cs.AI 新提交 79%

MutMem: Cryptographically Authorized Mutation in Persistent Agent Memory

MutMem:持久智能体内存中的密码学授权突变

Walid Saidi

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本研究针对持久智能体内存的授权与防篡改问题,提出HOM-AIMOS中的MutMem协议,经实验验证其在多个基准任务中表现良好,可有效抵御中毒攻击。

Comments https://github.com/wallidsaydi-creator/HOM-AIMOS. 32 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02553 2026-08-04 cs.AI 新提交 79%

A Taxonomy of Cognitive Capability Gaps in Generative and Agentic AI

生成式与智能体式AI中认知能力差距的分类学

Taye Akinrele, Sindhuja Penchala, Noorbakhsh Amiri Golilarz, Sudip Mittal, Shahram Rahimi

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI

AI总结 本文针对制约认知AI发展的认知能力差距开展分类学综述,梳理五大维度的进展与挑战,提出ACIA架构及认知导向评估框架,为构建可靠认知AI与AGI提供路线图。

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01710 2026-08-04 cs.AI 新提交 79%

Beyond Single-Use Tokens: Durable Authorization State for Replay-Resistant LLM Agent Actions

超越单次使用令牌:面向抗重放的大语言模型智能体行动的持久授权状态

Jinghan Xu, Longze Fan, Zeyuan Wang, Xinjin Li, Hankai Liu

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 该研究针对大语言模型智能体重规划等行为引发的语义重放问题,提出 CapLease 授权消耗层,结合服务器账本实现抗重放,证明持久授权状态是抗重放智能体执行的系统要求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01619 2026-08-04 cs.AI 新提交 79%

When Memory Updates but Behavior Does Not: Repairing Implicit Stale Dependencies in Personalized Agent Responses

当记忆更新但行为未更新时:修复个性化智能体响应中的隐式陈旧依赖

Haofei Sun, Lin He

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 该研究针对智能体存在的隐式陈旧依赖问题,提出StateAuditor反向审计方法,在STALE基准上实现显著性能提升,验证了转换机制对修复IPA缺口的有效性。

Comments 9 pages, 4 figures; supplementary material in ancillary files

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27080 2026-07-30 cs.CR cs.AI 新提交 79%

MemSecBench: Tracking Agent Memory Poisoning from Persistence to Consequence and Repair

MemSecBench:追踪智能体内存中毒从持久性到后果及修复的全生命周期

Xuanze Chen, Xukang Xie, Wentao Fu, Jiajun Zhou, Shanqing Yu, Qi Xuan

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本研究提出MemSecBench基准测试,通过24种配置的实验发现不同内存系统栈在智能体内存中毒的持久性、后果及选择性修复上存在显著差异,为智能体内存安全评估提供了工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25076 2026-07-29 cs.AI 新提交 79%

Towards an Agent Operating System - Lessons from Classical and Cloud OS

迈向智能体操作系统——从经典操作系统和云操作系统中汲取的经验教训

Gosia Steinder, Hubertus Franke

专题命中 记忆与上下文管理 :agent(title);agentic(abstract);分类 cs.AI

AI总结 智能体人工智能系统处于发展试验阶段,缺乏核心抽象概念共识。研究提出借鉴经典和云操作系统发展路径,扩展原语推导新智能体抽象概念,精确指定语义并整合,以推动该领域发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24368 2026-07-28 cs.CL 新提交 79%

Keep It InMind: Benchmarking the Implicit-Association Blind Spot in Agent Memory

牢记于心:评估智能体记忆中的隐式关联盲点

Ruizhe Li, Mingxuan Du, Benfeng Xu, Zhendong Mao

机构 * University of Science and Technology of China(中国科学技术大学) Metastone Technology(元石科技)

专题命中 记忆与上下文管理 :agent(title);agentic(abstract);分类 cs.CL

AI总结 研究智能体记忆中的隐式关联盲点问题,引入InMind基准测试,通过配对控制区分三种解释,实验发现将记忆置于上下文时主干回答间接查询比例高,检索相同记忆时其他系统召回率低,诊断探针可缩小差距,指出路由是关键问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22562 2026-07-28 cs.AI 新提交 79%

SF-AMS: Strategic Forgetting for Structured Memory in LLM Agent

SF-AMS:大语言模型智能体中结构化记忆的策略性遗忘

Ning Yang, Siqi Li, Miaoxin Shen, Yuan Zhou, Meng Zhang, Tong Li, Haijun Zhang

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 研究大语言模型智能体长上下文依赖瓶颈问题,提出SF-AMS框架,通过效用驱动机制和复合评分整合信号维护记忆,实验表明该方法在多跳推理等任务中相比基线有显著提升,证明建模记忆重要性对长上下文推理关键。

详情

展开后加载摘要…

URL PDF HTML 收藏