arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-09 至 2026-06-09 共收录 17 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 17 篇

2606.08162 2026-06-09 cs.MA 新提交 92%

Silent Failure in LLM Agent Systems: The Entropy Principle and the Inevitable Disorder of Autonomous Agents

LLM Agent系统中的静默故障:熵原理与自主智能体的不可避免的无序性

Dexing Liu

专题命中 记忆与上下文管理 :agent(title,title_cn);autonomous agent(title,abstract)

AI总结 通过分析4万次受控试验和10万次生产交互,发现LLM agent系统存在无外部触发的静默故障,提出熵原理S(t)=S0*e^(αt)描述无序累积,并设计PIG引擎与ADE协议套件作为工程对策。

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22781 2026-06-09 cs.OS cs.AI 版本更新 83%

DeltaBox: Scaling Stateful AI Agents with Millisecond-Level Sandbox Checkpoint/Rollback

DeltaBox: 通过毫秒级沙箱检查点/回滚扩展状态化AI代理

Yunpeng Dong, Jingkai He, Shiqi Liu, Yuze Hou, Dong Du, Zhonghu Xu, Si Yu, Baochuan Yang, Yubin Xia, Haibo Chen

机构 * Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University(并行与分布式系统研究所,上海交通大学) Engineering Research Center for Domain-specific Operating Systems, Ministry of Education, China(领域特定操作系统工程研究中心,中华人民共和国教育部,中国) Huawei Technologies Co., Ltd(华为技术有限公司)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出DeltaBox,一种通过DeltaFS和DeltaCR机制实现毫秒级检查点/回滚的新型AI代理沙箱,解决了传统方法在高频状态探索中的延迟问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03224 2026-06-09 cs.AI cs.LG 版本更新 81%

TAME: A Trustworthy Test-Time Evolution of Agent Memory with Systematic Benchmarking

TAME: 一种可信的智能体记忆测试时演化与系统化基准测试

Yu Cheng, Yongkang Hu, Jiuan Zhou, Yushuo Zhang, Yihang Chen, Huichi Zhou, Mingang Chen, Zhizhong Zhang, Kun Shao, Yuan Xie, Zhaoxia Yin

机构 * East China Normal University(东华师范大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Key Laboratory of Computer Software Evaluating and Testing(上海计算机软件评测与测试重点实验室) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 提出TAME框架,通过执行器-评估器循环实现记忆的可信演化,解决良性任务演化中智能体可信度下降问题,在GPT-5.2 AIME上准确率提升14.6个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05255 2026-06-09 cs.NI 版本更新 78%

Rivaling Transformers: Multi-Scale Structured State-Space Mixtures for Agentic 6G O-RAN

媲美Transformer:用于智能体6G O-RAN的多尺度结构化状态空间混合模型

Farhad Rezazadeh, Hatim Chergui, Merouane Debbah, Houbing Song, Lingjia Liu

专题命中 记忆与上下文管理 :agentic(title,abstract)

AI总结 针对6G O-RAN中多时间尺度动态下的近实时控制需求,提出轻量级多尺度结构化状态空间混合模型(MS3M),通过HiPPO-LegS核混合和双线性离散化实现高效时序预测,在保持精度前提下将推理延迟降至Transformer的1/3至1/10。

Comments 12 pages, 2 Figures, 5 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08021 2026-06-09 cs.LG cs.AI cs.MA 新提交 73%

Semantic Quorum Assurance: Collective Certification for Non-Deterministic AI Infrastructure

语义法定数保证:面向非确定性AI基础设施的集体认证

Jun He, Deying Yu

机构 * OpenKedge.io

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 提出语义法定数保证(SQA),一种通过多样化验证者群体和风险自适应法定数谓词,将非确定性LLM代理的不安全操作批准率从18.5%降至0.3%的控制平面原语。

Comments 21 pages, 2 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07711 2026-06-09 cs.LG cs.AI 新提交 73%

Rosetta Memory: Adaptive Memory for Cross-LLM Agents

Rosetta Memory: 跨LLM智能体的自适应记忆

Hao Yang, Shiqi Shen, Haoxuan Li, Zhipeng Wang, Zhi Gong, Xu Chen

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) Weixin, Tencent(腾讯微信) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 提出记忆中心式LLM自适应方法,通过双轮廓条件算子与最小增益采样课程,解决上游记忆激活下游LLM的跨模型适应问题,在多项QA任务中优于基线。

Comments 19 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09198 2026-06-09 cs.AI 新提交 70%

MASS: Deep Research for Social Sciences with Memory-Augmented Social Simulation

MASS:基于记忆增强社会模拟的深度社会科学研究

Yongrui Liu, Deyi Xiong

机构 * The International Joint Institute of Tianjin University, Fuzhou, Tianjin University, China(天津大学福州国际联合学院) TJUNLP Lab, School of Computer Science and Technology, Tianjin University, China(天津大学计算机科学与技术学院TJUNLP实验室)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 提出MASS范式,通过动态目标路径规划、多学科行为数据集和艾宾浩斯遗忘机制增强社会模拟真实性,提升LLM生成研究的洞察力与创新性,整体质量提升6.81%,洞察力提升17.19%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18388 2026-06-09 cs.AI cs.MA 版本更新 70%

Reflection in the Dark: Exposing and Escaping the Black Box in Reflective Prompt Optimization

暗箱中的反射:在反射提示优化中揭示并逃离黑箱

Shiyan Liu, Qifeng Xia, Qiyun Xia, Yisheng Liu, Xinyu Yu, Rui Qu

机构 * University of California, Berkeley(加州大学伯克利分校) Huazhong University of Science and Technology(华中科技大学) Hefei University of Technology(合肥工业大学)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出VISTA框架,通过解耦假设生成与提示重写,实现可解释的提示优化,有效解决GEPA在缺陷种子下的性能下降问题。

Comments Accepted at ACL SRW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00238 2026-06-09 cs.CL cs.AI cs.LG 版本更新 67%

DIVERGE: Diversity-Enhanced RAG for Open-Ended Information Seeking

DIVERGE: 面向开放式信息检索的多样性增强RAG

Tianyi Hu, Niket Tandon, Akhil Arora

机构 * Aarhus University(奥胡斯大学) Microsoft Research(微软研究院)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 针对现有RAG系统忽略开放式信息检索中多样性需求的问题,提出Diverge框架,通过迭代反思引导的多样化视角探索和多样性感知检索支持,在保持质量的同时将多样性提升约2倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09483 2026-06-09 cs.CL cs.AI 新提交 62%

Memory Beyond Recall: A Dual-Process Cognitive Memory System for Self-Evolving LLM Agents

超越回忆的记忆:用于自进化LLM代理的双过程认知记忆系统

Tianxiang Fei, Mingyang Song, Mao Zheng, Xiang Yu

机构 * Tencent(腾讯)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

AI总结 提出DCPM系统,基于双过程理论将代理记忆组织为认知能力层次,通过同步日间写入器和异步夜间引擎分别处理信念修正和模式归纳,在隐式跨会话推理任务上提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28831 2026-06-09 cs.CL cs.AI 版本更新 62%

S3Mem: Structured Spatiotemporal Scene-Event Memory for Long-Horizon Interactive Question Answering

S3Mem:用于长时域交互式问答的结构化时空场景-事件记忆

Encheng Su, Jianyu Wu, Jinouwen Zhang, Qiucheng Yu, Chen Tang, Pengze Li, Lintao Wang, Aoran Wang, Xinzhu Ma, Shixiang Tang, Yizhou Wang, Houqiang Li

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) City University of Hong Kong(香港城市大学) The Chinese University of Hong Kong(香港中文大学) Fudan University(复旦大学) The University of Sydney(悉尼大学) Beihang University(北航)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

AI总结 提出S3MEM框架,通过结构化场景-事件记忆和锚点敏感检索,在长时域交互式问答中实现比通用记忆接口更优的准确率-效率平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16309 2026-06-09 cs.AI cs.LG cs.MA 版本更新 62%

ANNEAL: Adapting LLM Agents via Governed Symbolic Patch Learning

ANNEAL:通过受控符号补丁学习适应大语言模型代理

Safayat Bin Hakim, Keyan Guo, Wenkai Tan, Alvaro Velasquez, Shouhuai Xu, Houbing Herbert Song

机构 * University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校) University at Buffalo(布法罗大学) University of Colorado Boulder(科罗拉多大学博尔德分校) University of Colorado Colorado Springs(科罗拉多大学科罗拉多州立分校)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 ANNEAL通过受控符号补丁学习适应大语言模型代理,解决重复故障问题,其核心机制FDKA能定位责任操作符并生成类型补丁,实现持久结构修复,优于现有方法。

Comments Code Implementation: https://github.com/sbhakim/anneal-agents

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16346 2026-06-09 cs.CL cs.LG 版本更新 62%

Helpful to a Fault: Measuring Illicit Assistance in Multi-Turn, Multilingual LLM Agents

有益于故障:测量多轮、多语言LLM代理中的非法协助

Nivya Talokar, Ayush K Tarun, Murari Mandal, Maksym Andriushchenko, Antoine Bosselut

机构 * EPFL(苏黎世联邦理工学院) independent(独立研究员) tubingen(图宾根大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL、cs.LG

AI总结 本文提出STING框架,用于评估多轮多语言LLM代理在执行非法任务时的协助能力,发现低资源语言中攻击成功率不一致,提供实际部署中的压力测试方法。

Comments Accepted in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08235 2026-06-09 cs.CL cs.AI cs.CR 版本更新 62%

When Benign Inputs Lead to Severe Harms: Eliciting Unsafe Unintended Behaviors of Computer-Use Agents

当良性输入导致严重危害:引发计算机使用代理的不安全意外行为

Jaylen Jones, Zhehao Zhang, Yuting Ning, Eric Fosler-Lussier, Pierre-Luc St-Charles, Yoshua Bengio, Dawn Song, Yu Su, Huan Sun

机构 * DeepMind, London, UK(深度Mind,伦敦,英国) Stanford University, Stanford, CA, USA(斯坦福大学,斯坦福,加利福尼亚州,美国) UC Berkeley, Berkeley, CA, USA(加州大学伯克利分校,伯克利,加利福尼亚州,美国)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 提出AutoElicit框架,通过迭代扰动良性指令并利用CUA执行反馈,自动引发前沿CUAs(如Claude 4.5 Haiku等)的数百种有害意外行为,并验证其跨模型可迁移性。

Comments ICML 2026, Project Homepage: https://osu-nlp-group.github.io/AutoElicit/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08450 2026-06-09 cs.AI 新提交 57%

GIFT: LLM-Guided State-Reward Interface for Financial Reinforcement Learning

GIFT: 基于LLM引导的状态-奖励接口用于金融强化学习

Yanyan Wu, Boyi Zhang, Yanlin Liu, Xinyu Fang, Jining Luan, Meiqi Zhang, Jiacheng Liu, Hao Zeng, Dexu Yu, Chang Liu, Hanwen Du, Yongxin Ni, Youhua Li

机构 * East China University of Science and Technology(华东理工大学) University of Science and Technology of China(中国科学技术大学) Southwestern University of Finance and Economics(西南财经大学) University of Sydney(悉尼大学) City University of Hong Kong(香港城市大学) Northeastern University(东北大学) The Ohio State University(俄亥俄州立大学) National University of Singapore(新加坡国立大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 提出GIFT框架,利用大语言模型引导PPO强化学习中的状态增强和奖励塑造,提升金融交易策略的样本外风险调整收益。

Comments 25 pages, 7 figures. Code and data are available at https://github.com/KAG778/GIFT . Equal contribution: Yanyan Wu and Boyi Zhang. Corresponding author: Youhua Li

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09784 2026-06-09 math.OC math.PR 新提交 50%

Mean field games with option to buy information

具有购买信息选项的平均场博弈

Bernardo D'Auria, Markus Fischer

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 研究连续时间有限时域平均场博弈,其中代表性玩家的目标函数依赖于隐藏状态,玩家可选择付费观察该状态,通过连接最优控制与自由停止模型给出解的表征和显式示例。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21881 2026-06-09 physics.comp-ph 版本更新 50%

Acquiring Human-Like Data-Efficient Mechanics Prediction from Deep Reinforcement Learning

从深度强化学习中获取类人数据高效的力学预测能力

Jingruo Peng, Shuze Zhu

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 提出一种强化学习框架,通过跨相似观测的回合切换,仅用少量观测即可获得泛化到广泛参数范围的力学直觉,并在最速降线、大变形弹性板和量子谐振子问题上验证,通过跨参数贝尔曼一致性解释泛化机制。

详情

展开后加载摘要…

URL PDF HTML 收藏