arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-05-12 至 2026-05-12 共收录 15 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 15 篇

2604.13630 2026-05-12 cs.CR cs.AI 83%

SafeHarness: Lifecycle-Integrated Security Architecture for LLM-based Agent Deployment

SafeHarness:面向LLM代理部署的生命周期集成安全架构

Xixun Lin, Yang Liu, Yancheng Chen, Yongxuan Wu, Yucheng Ning, Yilong Liu, Nan Sun, Shun Zhang, Bin Chong, Chuan Zhou, Yanan Cao

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院) Institute of Applied Physics and Computational Mathematics(应用物理与计算数学研究所) Peking University(北京大学)

专题命中 记忆与上下文管理 :agent(title,abstract);tool use(abstract);分类 cs.AI

AI总结 本文提出SafeHarness架构,通过四个防御层集成到代理生命周期中,解决现有安全方法的结构性不匹配问题,降低不安全行为和攻击成功率。

Comments 26 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09330 2026-05-12 cs.LG cs.AI 81%

The Trap of Trajectory: Towards Understanding and Mitigating Spurious Correlations in Agentic Memory

轨迹的陷阱:朝着理解并缓解代理记忆中的虚假相关性

Luoxi Tang, Rupali Rajendra Vaje, Yuqiao Meng, Sakshi Sunil Narkar, Weicheng Ma, Zeyu Ding, Dazheng Zhang, Zhaohan Xi

机构 * Binghamton University, State University of New York(宾夕法尼亚州立大学) Oakland University(奥克兰大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 本文研究代理记忆中的虚假相关性问题,通过基准测试揭示记忆在清洁输入下提升推理但放大虚假模式依赖性,并提出CAMEL方法在写入和检索时减少对虚假模式的依赖,同时保持性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10936 2026-05-12 cs.CV 80%

Personal Visual Context Learning in Large Multimodal Models

个人视觉上下文学习在大型多模态模型中

Zihui Xue, Ami Baid, Sangho Kim, Mi Luo, Kristen Grauman

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 记忆与上下文管理 :agentic(summary_cn,abstract)

AI总结 本文提出个人视觉上下文学习(Personal VCL)以解决个性化查询,通过Personal-VCL-Bench评估,发现现有模型在利用视觉证据和聚合多视觉观察方面存在显著不足,提出Agentic Context Bank方法提升性能。

Comments Project website: https://vision.cs.utexas.edu/projects/PersonalVCL/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10870 2026-05-12 cs.AI 79%

Remember the Decision, Not the Description: A Rate-Distortion Framework for Agent Memory

记住决策,而非描述:一种面向代理记忆的速率-失真框架

Mingxi Zou, Zhihan Guo, Langzhang Liang, Zhuo Wang, Qifan Wang, Qingsong Wen, Irwin King, Lizhen Qu, Zenglin Xu

机构 * Fudan University(复旦大学) The Chinese University of Hong Kong(香港中文大学) Meta AI AI Research Institute, Squirrel Ai Learning(Squirrel Ai Learning人工智能研究院) Monash University(墨尔本大学) Shanghai Academy of AI for Science(上海人工智能科学研究院)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本文提出一种以决策为核心的速率-失真框架,用于代理记忆管理,通过优化内存预算与决策质量的权衡,提出DeMem算法在合成数据和对话任务中提升了决策性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09942 2026-05-12 cs.AI 79%

HAGE: Harnessing Agentic Memory via RL-Driven Weighted Graph Evolution

HAGE: 通过RL驱动的加权图进化利用代理记忆

Dongming Jiang, Yi Li, Guanpeng Li, Qiannan Li, Bingzhe Li

机构 * Department of Computer Science, The University of Texas at Dallas(德克萨斯大学达拉斯分校计算机科学系) Department of Electrical and Computer Engineering, University of Florida(佛罗里达大学电气与计算机工程系) University of California, Davis(加州大学戴维斯分校)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI

AI总结 HAGE提出了一种加权多关系记忆框架,通过RL驱动的训练框架优化路由行为和边表示,提升长周期推理准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08271 2026-05-12 cs.CV cs.AI 79%

Bridging Modalities, Spanning Time: Structured Memory for Ultra-Long Agentic Video Reasoning

跨模态、跨时间:结构化记忆用于超长代理视频推理

Jiazheng Li, Chi-Hao Wu, Yunze Liu, Kaize Ding, Jundong Li, Chuxu Zhang

机构 * University of Connecticut(康涅狄格大学) Northwestern University(西北大学) University of Virginia(弗吉尼亚大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI

AI总结 本文提出MAGIC-Video框架,通过多模态记忆图和交织叙事链,实现超长视频的跨模态检索与长时序推理,优于现有基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11258 2026-05-12 cs.LG cs.AI cs.CL 75%

Knowledge is Not Enough: Injecting RL Skills for Continual Adaptation

知识不足:注入强化学习技能以实现持续适应

Pingzhi Tang, Yiding Wang, Muhan Zhang

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) Yuanpei College, Peking University(北京大学元培学院)

专题命中 记忆与上下文管理 :tool-use(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出PaST框架,通过提取领域无关的Skill Vector,实现高效知识适应。实验表明PaST在知识问答和工具使用任务中优于现有方法,展现出良好的可扩展性和跨领域迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13896 2026-05-12 q-bio.QM cs.AI cs.CV cs.MA 70%

GenCellAgent: Generalizable, Training-Free Cellular Image Segmentation via Large Language Model Agents

GenCellAgent:基于大语言模型代理的通用、无需训练的细胞图像分割

Xi Yu, Yang Yang, Qun Liu, Yonghua Du, Sean McSweeney, Yuewei Lin

机构 * Artificial Intelligence Department, Brookhaven National Laboratory, Upton, 11973, NY, US(1 人工智能部门,布鲁赫萨尔国家实验室,乌普顿,11973,纽约,美国) National Synchrotron Light Source II, Brookhaven National Laboratory, Upton, 11973, NY, US(2 国家同步辐射光源II,布鲁赫萨尔国家实验室,乌普顿,11973,纽约,美国) Biology Department, Brookhaven National Laboratory, Upton, 11973, NY, US(3 生物学部门,布鲁赫萨尔国家实验室,乌普顿,11973,纽约,美国)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 GenCellAgent通过规划-执行-评估循环实现无需训练的细胞图像分割,自动分配最佳工具并支持文本引导分割,优于现有方法且减少标注负担。

Comments 43 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10223 2026-05-12 cs.AI cs.SE 62%

Beyond Autonomy: A Dynamic Tiered AgentRunner Framework for Governable and Resilient Enterprise AI Execution

超越自主性:一种动态分层代理运行框架用于可控且具有弹性的企业AI执行

Kai Pan, Rong Hou

机构 * a2alab(a2alab实验室)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出动态分层代理运行框架,通过风险自适应分层、权力分离架构和容错设计,解决企业AI执行中的可控性和可靠性问题。

Comments 9 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10044 2026-05-12 cs.LG cs.AI 62%

Adaptive Action Chunking via Multi-Chunk Q Value Estimation

基于多片段Q值估计的自适应动作分块

Yongjae Shin, Jongseong Chae, Seongmin Kim, Jongeui Park, Youngchul Sung

机构 * KAIST(韩国科学技术院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出自适应动作分块方法,通过动态调节分块长度提升强化学习性能,实验表明其在复杂环境中具有更好的泛化能力和学习效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00370 2026-05-12 cs.LG cs.CY cs.MM 57%

Group Cognition Learning: Making Everything Better Through Governed Two-Stage Agents Collaboration

群体认知学习:通过受控的双阶段智能体协作使一切变得更好

Chunlei Meng, Pengbin Feng, Rong Fu, Hoi Leong Lee, Xiaojing Du, Zhaolu Kang, Zeyu Zhang, Weilin Zhou, Chun Ouyang, Zhongxue Gan

机构 * University of Macau(澳门大学) Universiti Malaysia Perlis(马来西亚霹雳大学) Peking University(北京大学) Xinjiang University(新疆大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本文提出群体认知学习框架,通过双阶段智能体协作解决多模态学习中的模态主导和虚假耦合问题,实验表明其在回归和分类任务中达到最优性能。

Comments This study has been Accepted by ICML 2026. The current version is a manuscript, please refer to the official version released at ICML 2026 for the final published version

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08581 2026-05-12 cs.LG 57%

PRISM: Fast Online LLM Serving via Scheduling-Memory Co-design

PRISM: 通过调度-内存协同设计实现快速在线LLM服务

Xingyu Qu, Tianhao Lin, Yiqi Li, Zhiyu Chen, Sheng Wang

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 PRISM通过协同设计调度与内存管理,优化LLM服务响应时间,减少TTFT并提升缓存命中率。

Comments 25 pages, 9 figures, Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09937 2026-05-12 cs.DC cs.FL 50%

Population Protocols over Ordered Agents

基于有序代理的人群协议

Michael Blondin, Michaël Cadilhac, Benjamin Courchesne, Lucie Guillou, Corto Mascle, Isa Vialard

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究了基于有序代理的人群协议,探讨了其在识别无歧义星形自由语言中的作用,并展示了在特定条件下协议与空间复杂度的关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09785 2026-05-12 eess.SY cs.GT cs.SY math.OC 50%

Action Recommendations for Sequentially Rational Strategic Agents

为序列理性战略代理制定动作推荐

Renyan Sun, Ashutosh Nayyar

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究如何通过动作推荐激励战略代理采用服从策略,提出基于逆向归纳法求解线性规划的算法,以实现设计者目标与代理序列理性之间的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13451 2026-05-12 cs.RO 50%

MapNav: A Novel Memory Representation via Annotated Semantic Maps for Vision-and-Language Navigation

MapNav: 一种通过标注语义地图的新型记忆表示方法用于视觉-语言导航

Lingfeng Zhang, Xiaoshuai Hao, Qinwen Xu, Qiang Zhang, Xinyao Zhang, Pengwei Wang, Jing Zhang, Zhongyuan Wang, Shanghang Zhang, Renjing Xu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Tsinghua University(清华大学) Beijing Innovation Center of Humanoid Robotics Co., Ltd.(北京人形机器人创新中心有限公司) School of Computer Science, Wuhan University(武汉大学计算机学院) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学多媒体信息处理国家重点实验室,计算机学院)

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出MapNav,通过标注语义地图替代传统历史帧,提升视觉-语言导航任务的性能,实验表明其在模拟和现实环境中均达到SOTA水平。

详情

展开后加载摘要…

URL PDF HTML 收藏