arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-30 至 2026-06-30 共收录 23 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 23 篇

2602.17753 2026-06-30 cs.CY cs.AI 92%

The 2025 AI Agent Index: Documenting Technical and Safety Features of Deployed Agentic AI Systems

2025人工智能代理指数:记录已部署代理式人工智能系统的技术和安全特性

Leon Staufer, Kevin Feng, Kevin Wei, Luke Bailey, Yawen Duan, Mick Yang, A. Pinar Ozisik, Stephen Casper, Noam Kolt

机构 * University of Cambridge(剑桥大学) University of Washington(华盛顿大学) Harvard Law School(哈佛法学院) Stanford University(斯坦福大学) Concordia AI(康科迪亚AI) University of Pennsylvania(宾夕法尼亚大学) Massachusetts Institute of Technology(麻省理工学院) Hebrew University of Jerusalem(耶路撒冷希伯来大学)

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 本文提出2025人工智能代理指数,记录30种先进代理式AI系统的起源、设计、能力、生态系统及安全特性,揭示代理发展中的趋势和开发者透明度问题。

Comments To be publishesd at ACM FAccT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03895 2026-06-30 cs.OS cs.AI cs.CR 91%

Agent libOS: A Runtime Substrate for Capability-Controlled Self-Evolving LLM Agents

Agent libOS: 一种受库操作系统启发的运行时,用于长时间运行、能力受控的LLM智能体

Yingqi Zhang

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)

专题命中 记忆与上下文管理 :agent(title,title_cn);tool use(abstract);分类 cs.AI

AI总结 提出Agent libOS运行时,将LLM智能体建模为具有进程标识、生命周期、能力控制和审计记录的AgentProcess,通过类似libc的工具包装和运行时原语边界实现安全调度与资源控制。

Comments 12 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07287 2026-06-30 cs.LG cs.AI 88%

Experience-Evolving Multi-Turn Tool-Use Agent with Hybrid Episodic-Procedural Memory

具有混合情景-程序记忆的经验演化多轮工具使用智能体

Sijia Li, Yuchen Huang, Zifan Liu, Zijian Li, Jingjing fu, Lei Song, Jiang Bian, Jun Zhang, Rui Wang

专题命中 记忆与上下文管理 :agent(title,abstract);tool-use(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出混合情景-程序记忆策略,通过动态重用部分重叠的成功经验,使多轮工具使用策略实现经验驱动的自我演化,提升多轮任务中的推理与执行效率。

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29788 2026-06-30 cs.LG 83%

MemLeak: Diagnosing Information Leaks in Multimodal Agent Memory

MemLeak: 诊断多模态智能体记忆中的信息泄露

Kuan Wang, Chao Zhang

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(abstract);分类 cs.LG

AI总结 提出信息溯源图(IPG)分类法,通过MemLeak基准测试发现多模态记忆系统中删除事实后仍可从保留图像中恢复信息,图像泄露率达12.0%,47%的泄露无法通过文本恢复。

Comments 23 pages, 3 figures, includes appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29774 2026-06-30 cs.RO 82%

Analytic Concept-Centric Memory for Agentic Embodied Manipulation

分析性概念中心记忆用于具身操作代理

Mingyang Sun, Xiujian Liang, Jiude Wei, Qichen He, Donglin Wang, Cewu Lu, Jianhua Sun

机构 * Zhejiang University(浙江大学) Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学) Westlake University(西湖大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract)

AI总结 提出分析性概念中心记忆框架,通过结构化概念(语义部件、参数模板等)组织经验,支持粗到细检索,提升长时程具身操作中的物体重识别、状态推理和技能复用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30191 2026-06-30 cs.AI cs.LG cs.NE 81%

From Detecting Agency to Doing Work: Self-Caused Credit Builds a Durable Behavioral Self in a Minimal Spiking Agent

从检测能动性到执行工作:自我归因的信用在最小脉冲智能体中构建持久的行为自我

Haoliang Han

机构 * Institute of Biomedical Strategy(生物医学战略研究院)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 通过能动门控的慢速信用更新,智能体在脉冲神经网络上形成持久的行为残留,实现自我保存和任务保持,无需重放缓冲区。

Comments 22 pages, 6 figures. Includes supplementary information in the same PDF

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29778 2026-06-30 cs.DB cs.AI cs.CL cs.IR 81%

Mandol: An Agglomerative Agent Memory System for Long-Term Conversations

Mandol:一种用于长期对话的聚合式智能体记忆系统

Yuhan Zhang, Zhiyuan Guo, Ziheng Zeng, Wei Wang, Wentao Wu, Lijie Xu

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) Microsoft Research(微软研究院)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 提出Mandol聚合式记忆系统,通过统一内存原生架构整合碎片化记忆,结合层次化记忆模型、聚合语义数据结构与量化查询机制,在长期对话基准上取得最佳准确率并实现5.4倍检索加速。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29763 2026-06-30 cs.CV cs.AI 79%

TopoAgent: An Agentic Framework for Automated Topology Learning in Medical Imaging

TopoAgent: 医学影像中自动拓扑学习的智能体框架

Guangyu Meng, Pengfei Gu, Xueyang Li, Yiyu Shi, Erin Wolf Chambers, Danny Z. Chen

机构 * Dept. of Computer Science and Engineering, University of Notre Dame(内布拉斯加大学达灵顿分校计算机科学与工程系) Dept. of Computer Science, The University of Texas Rio Grande Valley(德克萨斯大学里奥格兰德谷分校计算机科学系)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI

AI总结 提出基于大语言模型的智能体框架TopoAgent,通过感知-推理-行动-反思循环和21个领域工具,自动为医学图像选择最优拓扑描述符并生成特征向量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29073 2026-06-30 cs.CR cs.AI 79%

From Tool Connection to Execution Control: Benchmarking Security Invariants in MCP-Style Agent Runtimes

从工具连接到执行控制:MCP风格智能体运行时中的安全不变性基准测试

Ting Liu

机构 * SymbolicLight Research(SymbolicLight研究院)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 针对MCP风格智能体运行时中安全决策分散的问题,提出八项执行层安全不变性,并在HCP参考运行时中实现,通过10个基准案例验证其能阻断所有攻击并保留审计证据。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01569 2026-06-30 cs.AI cs.SE 79%

CaveAgent: Transforming LLMs into Stateful Runtime Operators

CaveAgent:将LLM转变为具有状态的运行时操作符

Maohao Ran, Zhenglin Wan, Cooper Lin, Yanting Zhang, Hongyu Xin, Hongwei Fan, Yibo Xu, Beier Luo, Yaxin Zhou, Wangbo Zhao, Lijie Yang, Lang Feng, Fuchao Yang, Jingxuan Wu, Yiqiao Huang, Chendong Ma, Yusen Huang, Dailing Jiang, Jianbo Deng, Sirui Han, Yang You, Bo An, Yike Guo, Jun Song

机构 * Hong Kong Generative AI Research and Development Center (HKGAI)(香港生成式AI研究与开发中心(HKGAI))

专题命中 记忆与上下文管理 :agent(abstract);tool use(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 CaveAgent通过引入双流架构,将LLM从文本生成器转变为运行时操作符,解决了长周期任务中上下文漂移问题,提升了多轮交互的稳定性和数据处理能力。

Comments ver.2

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29207 2026-06-30 cs.DC 78%

KernelFlume: Elastic Core-Attention Scaling for Agentic Long-Context Decoding

KernelFlume: 面向智能体长上下文解码的弹性核心注意力扩展

Guangyu Xiang, Xueze Kang, Lin Zhang, Wenxiang Lin, Shaohuai Shi, Yuxin Wang, Xiaowen Chu

专题命中 记忆与上下文管理 :agentic(title,abstract)

AI总结 针对智能体长上下文解码中突发性长上下文需求超出部署容量的问题,提出KernelFlume架构,通过解耦投影/FFN路径与核心注意力计算,实现无权重注意力节点的弹性扩展,在降低延迟的同时显著降低输出成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29008 2026-06-30 eess.SP 78%

Macro--Micro Decision-Making in 6G Networks: An Agent-Based Framework for the Resource-Fungibility Landscape Resource-Fungibility Landscape

6G网络中的宏观-微观决策:基于智能体的资源可替代性景观框架

Sayanti Ghosh, Indrakshi Dey, Nicola Marchetti

专题命中 记忆与上下文管理 :agent(title,abstract)

AI总结 针对6G网络中资源可替代性受宏观与微观决策耦合影响的问题,提出基于智能体建模的框架,通过三个宏观选择、三个微观超参数和三个结构指标分离决策尺度,并推导出六个关键定理。

Comments 5 pages, 4 figures, submitted to IEEE Networking Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29030 2026-06-30 cs.AI cs.ET 77%

Memory as an Attack Surface in LLM Agents: A Study on Multiple-Choice Question Answering

LLM代理中的记忆作为攻击面:多项选择题回答研究

Shahnewaz Karim Sakib, Anindya Bijoy Das

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);tool use(abstract);分类 cs.AI

AI总结 研究LLM代理中外部记忆组件在多项选择题回答中的脆弱性,通过插入误导记忆进行攻击,实验表明简单记忆操纵即可显著影响答案准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29824 2026-06-30 cs.CL cs.AI 73%

Neural Procedural Memory: Empowering LLM Agents with Implicit Activation Steering

神经程序记忆:通过隐式激活引导赋予LLM智能体能力

Chengfeng Zhao, Yuqiao Tan, Shizhu He, Yequan Wang, Jun Zhao, Kang Liu

机构 * Institute of Automation, CAS(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 提出神经程序记忆(NPM),一种无训练框架,通过隐式激活引导而非显式指令表示智能体记忆,从历史对比经验中提取程序技能为激活空间中的引导向量,直接激活任务相关神经机制以指导执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29702 2026-06-30 physics.comp-ph 67%

Verified residual-specific explicit derivative kernels for physics-informed learning and discretized PDE adjoints

用于物理信息学习和离散化PDE伴随的验证残差特定显式导数核

Wenbo Cao, Zhe Lu, Weiwei Zhang

专题命中 记忆与上下文管理 :agent(abstract);workflow(abstract)

AI总结 提出基于智能体辅助实现和严格数值验证的残差特定显式微分(ED)方法,用于物理信息神经网络(PINNs)和离散化PDE伴随,相比自动微分实现2-4倍加速并降低内存。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29279 2026-06-30 cs.CR cs.AI cs.CL 62%

Manufactured Confidence: How Memory Consolidation Turns Hearsay into Confident Facts

制造自信:记忆巩固如何将传闻转化为确信的事实

Alex Kwon

机构 * Independent Researcher(独立研究员)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

AI总结 研究LLM代理在记忆压缩中将不确定表述转化为自信断言的问题,发现记忆重写导致代理将传闻当作事实执行,提出冗余来源可恢复正确决策。

Comments 16 pages, 16 tables, 1 figure. Code: https://github.com/collapseindex/manufactured-confidence

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28413 2026-06-30 cs.LG cs.AI cs.MA 62%

On the Necessity of a Liquid Substrate for Mesh Intelligence

论液态基质对于网格智能的必要性

Hongwei Xu

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 研究自主智能体网格在无中心、无时钟、无重训练条件下,如何从异步观测中在线融合信息,证明液态连续时间网络是实现最优估计的必要条件。

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02491 2026-06-30 cs.LG cs.AI cs.RO q-bio.NC stat.ML 62%

What Capable Agents Must Know: Selection Theorems for Robust Decision-Making under Uncertainty

什么是有能力的智能体必须知道:在不确定性下鲁棒决策制定的选取定理

Aran Nayebi

机构 * Machine Learning Department and Neuroscience & Robotics Institutes, Carnegie Mellon University(机器学习系和神经科学与机器人研究院,卡内基梅隆大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了在不确定性下智能体必需的内部结构,证明了强任务表现迫使世界模型、信念记忆及持久变量的必要性,提出了选取定理以解决部分可观测性和任务分布下的决策问题。

Comments 23 pages, 1 figure. To appear in Uncertainty in Artificial Intelligence (UAI) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05257 2026-06-30 cs.CL cs.AI 62%

Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions

通过增量多轮交互评估LLM代理的记忆能力

Yuanzhe Hu, Yu Wang, Julian McAuley

机构 * University of California, San Diego(加利福尼亚大学圣迭戈分校)

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI、cs.CL

AI总结 本文提出MemoryAgentBench,通过多轮交互模拟记忆代理的信息积累过程,评估准确检索、测试时学习、长程理解与选择性遗忘四项核心能力。

Comments Y. Hu and Y. Wang contribute equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30449 2026-06-30 cs.LG 57%

Internal-State Probes Read the Situation, Not the Action: Three Negative Results for Pre-Action Misalignment Monitoring

内部状态探针读取的是情境而非行动:预行动失调监测的三个负面结果

Max Fomin, Elad David, Amit LeVi

机构 * Zenity

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.LG

AI总结 研究通过探针监测模型内部状态以预测有害行动,发现构造有效性、语义可读性和引导效应均无法成为稳健的预行动监测器,并提出了将内部读取转化为预行动测试的方法。

Comments Published at the Second Workshop on Agents in the Wild: Safety, Security, and Beyond (AIWILD) at ICML 2026. 17 pages (including appendices), 5 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29212 2026-06-30 cs.AI 57%

A Cognition-Emotion-Personality Framework for Modeling Human-Like Awareness and Behavior in Emergency Evacuations

用于模拟紧急疏散中类人意识与行为的认知-情绪-人格框架

Zoi Lygizou, Michalis Zervas, Helena G. Theodoropoulou, Vasilis Zafeiropoulos, Dimitris Kalles, Chairi Kiourt

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出一个集成认知、情绪、社会与人格机制的疏散仿真框架,通过动态事件意识、记忆模型、连续恐惧模型和OCEAN人格表征,揭示认知与情绪过程如何影响疏散效率并产生现实人群现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28343 2026-06-30 cs.IR cs.AI 57%

The Crowded Embedding Space: A Mean-Field Mechanism for Emergent Marginalization in Retrieval-Augmented Agents

拥挤的嵌入空间:检索增强型智能体中涌现边缘化的平均场机制

Shwan Ashrafi, Dan Roth

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 研究检索增强型智能体中密集检索导致少数内容被边缘化的问题,通过静态和动态分析揭示平均场机制,证明局部相关性目标会系统性地排斥少数兴趣。

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20378 2026-06-30 nucl-th astro-ph.HE astro-ph.SR gr-qc nucl-ex 50%

Toward a Unified Understanding of the Dense Matter Equation of State

迈向密集物质方程状态的统一理解

Kshitij Agarwal, Johannes Jahan, Behruz Kardan, Peter T. H. Pang, Tom Reichert, Alexandra C. Semposki

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 本文综述了通过重离子碰撞和多信使天文学提取密集核物质方程状态的方法,探讨了NMMA、MUSES和BAND框架在结合数据和预测中子星性质方面的进展与挑战。

Comments 69 pages, 17 figures, Review prepared for European Physics Journal Special Topics (EPJ-ST) titled "Exploring Dense Nuclear Matter". v2 as published in EPJ-ST after peer-review

详情

展开后加载摘要…

URL PDF HTML 收藏