arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-19 至 2026-08-19 共收录 13 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 13 篇

2606.03895 2026-08-19 cs.OS cs.AI cs.CR 版本更新 90%

Agent libOS: A Runtime Substrate for Capability-Controlled Self-Evolving LLM Agents

Agent libOS: 一种受库操作系统启发的运行时,用于长时间运行、能力受控的LLM智能体

Yingqi Zhang

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)

专题命中 记忆与上下文管理 :agent(title,title_cn);分类 cs.AI

AI总结 提出Agent libOS运行时,将LLM智能体建模为具有进程标识、生命周期、能力控制和审计记录的AgentProcess,通过类似libc的工具包装和运行时原语边界实现安全调度与资源控制。

Comments 20 pages, 3 figures, 7 tables. Project page: this https URL (https://github.com/yingqi-z20/Agent-libOS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17007 2026-08-19 cs.AI 新提交 83%

SkillEffect: Checked Lowering for Memory-Bounded Agent Tools

SkillEffect:面向内存受限智能体工具的经校验的降阶机制

Yinuo Wang, Yiyu Shi

机构 * Sichuan University(四川大学) University of Notre Dame(圣母大学)

专题命中 记忆与上下文管理 :agent(title,abstract);tool use(abstract);分类 cs.AI

AI总结 本文提出SkillEffect架构,通过经校验降阶运行时与独立校验器,在智能体工具调度时强制实施异构内存关系,可降低峰值内存并提升固定内存上限下的任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17684 2026-08-19 cs.AI 新提交 81%

Auditing Self-Evolution in Financial Agents: Capability Gains, Security Drift, and Execution-Interface Mismatch

金融智能体的自我进化审计:能力提升、安全漂移与执行接口不匹配

Jialong Li, Jialing Zhu

专题命中 记忆与上下文管理 :agent(abstract,abstract_cn);workflow(abstract,abstract_cn);分类 cs.AI

AI总结 该研究通过模拟电子银行环境审计SkillOpt、AWM、ReasoningBank等自我进化金融智能体,发现仅靠准确率评估不足,需跟踪退化、攻击面接触等指标,且AWM存在执行接口不匹配的评估风险。

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17209 2026-08-19 cs.RO cs.AI cs.CV cs.LG 新提交 81%

Teach and Grow: An Agent-Centered Architecture for General Robot Learning

教学与成长:面向通用机器人学习的智能体中心架构

Chang Nie, Zhe Liu, Hesheng Wang

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 该研究提出TGL智能体中心架构,通过将演示转化为可复用技能块,无需特定任务再训练即可实现通用机器人学习,在LIBERO评估中达SOTA性能,还提出相关缩放定律假设。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17665 2026-08-19 cs.AI 新提交 79%

GraphWake: Group Polarization via Memory-Mediated Polarization Cascade in LLM-Agent Communities

GraphWake:LLM智能体社群中基于记忆介导极化级联的群体极化

Haoran Bu, Zejian Chen, Litian Zhang, Xi Zhang

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 该研究提出名为GraphWake的新型威胁,通过记忆介导极化级联操纵LLM智能体社群,实验证实其可大幅提升群体极化程度,揭示了社群层面的极化风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17148 2026-08-19 cs.CR cs.AI 新提交 79%

Authorization Before Context: A Model-Neutral Audience Boundary Against Cross-Audience Memory Leakage in Agentic Systems

上下文之前的授权:一种针对智能体系统中跨受众记忆泄露的模型无关受众边界

Sibo Liu

专题命中 记忆与上下文管理 :agentic(title);agent(abstract);分类 cs.AI

AI总结 本研究针对智能体系统的跨受众记忆泄露问题,提出模型无关的受众边界方法,通过反单调授权规则确保未授权事实不进入上下文,在合成数据集上验证了其有效性。

Comments 13 pages, 3 figures. Author preprint. Accepted for presentation at AdvML-Frontiers x CoTMA, a non-archival workshop at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18005 2026-08-19 cs.CV 版本更新 78%

UrbanWorld2.0: A Multimodal Agentic Framework for Reality-Aligned 3D World Generation at City-Scale

RAISECity: 一种用于城市级现实对齐3D世界生成的多模态代理框架

Shengyuan Wang, Zhiheng Zheng, Yu Shang, Lixuan He, Yangcheng Yu, Fan Hangyu, Jie Feng, Qingmin Liao, Yong Li

机构 * College of AI, Tsinghua University(人工智能学院,清华大学) Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学) Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系,北京研究院,清华大学)

专题命中 记忆与上下文管理 :agentic(title,abstract)

AI总结 RAISECity通过多模态代理框架实现城市级3D世界生成,提升现实对齐、精度和性能,适用于沉浸媒体和具身智能应用。

Comments Accepted by ACM MM 2026, the code is available at: this https URL (https://github.com/tsinghua-fib-lab/UrbanWorld2.0)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17471 2026-08-19 cs.AI cs.LG 新提交 62%

When AI Designs AI: Innovation or Imitation?

当AI设计AI:创新还是模仿?

Yikang Yang, Zhengxin Yang, Luzhou Peng, Minghao Luo, Yanqi Kan, Wanling Gao, Jianfeng Zhan

机构 * University of Chinese Academy of Sciences(中国科学院大学) Northwestern University(西北大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 该研究对比LLM智能体与人类设计AI方法的性能和算法差异,发现智能体偶达SOTA但无法泛化,96.8%的设计属人类推导空间,多为算法选择的复用重组。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17347 2026-08-19 cs.LG cs.RO 新提交 57%

Repetition as Reinforcement: Enhancing Sample Efficiency via Instant Episode Repetition in Reinforcement Learning

重复作为强化:通过强化学习中的即时回合重复提升样本效率

Hoda Yamani, Yuning Xing, Koen van Rijnsoever, Bruce A. MacDonald, Henry Williams

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 受人类学习的重复机制启发,提出即时回合重复(IER)机制,将其集成至 SAC、TD3 算法并在多类基准任务上验证,可提升强化学习的样本效率与学习性能。

Comments 23 pages, 12 figures. Accepted at RLC 2026; to appear in Reinforcement Learning Journal (RLJ) 2026. Code: this https URL (https://github.com/UoA-CARES/instant-episode-repetition)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14889 2026-08-19 cs.CV cs.AI 版本更新 57%

SurgicalMamba: Dual-Path SSD with State Regramming for Online Surgical Phase Recognition

SurgicalMamba: 具有状态重编程的双路径SSD用于在线手术阶段识别

Sukju Oh, Sukkyu Sun

机构 * Department of Computer Science and Artificial Intelligence(计算机科学与人工智能系)

专题命中 记忆与上下文管理 :workflow(abstract);分类 cs.AI

AI总结 提出SurgicalMamba模型,基于Mamba2的结构化状态空间对偶性(SSD),通过双路径SSD块、强度调制步进和状态重编程三个组件,实现在线手术阶段识别,在多个基准上达到最先进性能。

Comments Code: this https URL (https://github.com/sukjuoh/Surgical-Mamba)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17349 2026-08-19 cs.DC 新提交 50%

Brief Announcement: Fair Binding for Hidden-State Authorization in Byzantine SMR

简短公告:拜占庭SMR中隐藏状态授权的公平绑定

Arnab Mallick

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 针对拜占庭SMR中隐藏状态授权问题,提出公平预留/使用协议,满足授权安全性与先到者活性,解决隐藏资源安全动态分配问题。

Comments Accepted at DISC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17054 2026-08-19 cs.HC 新提交 50%

Why This and Not That? A Collaborative Reflection Approach for Understanding Thought Coverage in Decision Making Support Dialog

为何选此而非彼?一种用于理解决策支持对话中思维覆盖的协作反思方法

Morita Tarvirdians, Hayley Hung, Catharine Oertel

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 该研究针对决策支持对话智能体的自适应策略易误判用户状态的问题,提出以人为中心的协作反思方法,经用户研究发现用户解释可指导更恰当的对话动作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14421 2026-08-19 cs.CY 版本更新 50%

Estimating the growth in emissions from AI data centres

估算AI数据中心的排放增长

Wim Vanderbauwhede

专题命中 记忆与上下文管理 :agentic(abstract)

AI总结 本研究采用先进生命周期评估模型,结合IEA与麦肯锡情景,量化AI数据中心扩张的排放,发现AI行业推崇的情景会使总排放大幅上升,隐含碳分量显著。

Comments 5 pages, 2 figures. Accepted at the 2nd International Workshop on Low Carbon Computing (LOCO 2026), Lancaster University, United Kingdom, 10-11 September 2026. Part of the LOCO 2026 proceedings, arXiv:LOCO2026/P05

详情

展开后加载摘要…

URL PDF HTML 收藏