arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-11 至 2026-08-11 共收录 25 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 25 篇

2608.08253 2026-08-11 cs.AI cs.IR 新提交 85%

SuperLocalMemory 4.0: The Governed Memory Operating System for AI Agents

SuperLocalMemory 4.0:面向AI智能体的受管控内存操作系统

Varun Pratap Bhardwaj, Garima Singh, Arun Pratap Bhardwaj

机构 * Qualixar(奎利克萨)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出SuperLocalMemory 4.0,一款面向AI智能体的受管控本地优先内存操作系统,整合多类型检索与管控功能,经测试其可靠性达标,为AI智能体提供持久化内存解决方案。

Comments 35 pages, 17 figures, 4 tables. Zenodo DOI: 10.5281/zenodo.21853302. Code: https://github.com/qualixar/superlocalmemory/releases/tag/v4.0.0

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28533 2026-08-11 cs.CL 版本更新 83%

GraphWalker: Agentic Knowledge Graph Question Answering via Synthetic Trajectory Curriculum

GraphWalker: 通过合成轨迹课程实现基于知识图谱的代理问答

Shuwen Xu, Yao Xu, Jiaxiang Liu, Chenhao Yuan, Wenshuo Peng, Jun Zhao, Kang Liu

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所复杂系统认知与决策智能重点实验室) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.CL

AI总结 GraphWalker通过自动化轨迹合成和分阶段微调解决知识图谱问答中的探索与泛化问题,提升轻量强化学习性能,在CWQ和WebQSP上取得最优效果。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02508 2026-08-11 cs.LG cs.CL 版本更新 81%

RoMeRL: Balancing Feedback Coverage and the Memory-Reward Trap in Self-Evolving Agent Memory via Reduced-Order Utility States

RoMeRL:通过降阶效用状态平衡自进化智能体记忆中的反馈覆盖与记忆-奖励陷阱

Yi Yang, Zhennan Chen, Yihong Zhuang, Tiehan Fan, Yinan Chen, Jian Li, Jian Yang, Ying Tai

机构 * Nanjing University(南京大学) Xiamen University(厦门大学) Zhejiang University(浙江大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL、cs.LG

AI总结 RoMeRL通过降阶效用状态解决自进化LLM智能体记忆的反馈分散与记忆-奖励陷阱问题,在ALFWorld等基准上显著提升任务性能、降低记忆规模与LLM调用

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09184 2026-08-11 cs.AI 新提交 79%

Agentic Router: An Execution-Grounded Continual Learning Approach With Memory

智能体路由器:一种基于执行的带记忆的持续学习方法

Yuxuan Chen, Rongpeng Li, Zhifeng Zhao, Yuntao Liu, Xing Xu, Honggang Zhang

机构 * Zhejiang University(浙江大学) Zhejiang Lab(之江实验室) State Grid Hebei Electric Power Co., Ltd.(国网河北省电力有限公司) Macau University of Science and Technology(澳门科技大学)

专题命中 记忆与上下文管理 :agentic(title);agent(abstract);分类 cs.AI

AI总结 该研究针对CLI-based SONiC操作,提出基于执行的双路径后果感知智能体,通过生成动作、预测后果、重排序选择,提升可行动作覆盖度与执行成功率,两条路径互补增益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08612 2026-08-11 cs.CV cs.AI 新提交 79%

REVEAL: A Rubric-Guided Agent for Explicit Evidence Sufficiency Verificationin Long-Video Question Answering

REVEAL:用于长视频问答的基于 rubric(评分标准)的显式证据充分性验证智能体

Caijun Yan, Yang Zhou, Meixing Shi, Haoran Sun, Yichen Li, Yuxiang Cai, Yankai Jiang

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 该研究针对长视频问答中现有方法割裂事件、忽略证据充分性的问题,提出REVEAL框架,通过自适应分块的结构化记忆与rubric引导的证据验证,实现更可靠的推理且性能优于现有SOTA方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08131 2026-08-11 cs.CR cs.AI cs.MA 新提交 79%

Compositional Threat Analysis of Latent Compromise in LLM Agent Systems: The Order 66 Scenario

LLM智能体系统中潜在入侵的组合式威胁分析:66号指令场景

Satoshi Matsuoka

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本文以66号指令为场景,提出组合模型分析LLM智能体系统的潜在入侵威胁,分离三类传播路径,指出现有防御无法封闭所有路径,最强防御为能力调解等四项措施,暂未发现完整场景的公开观测。

Comments Version 11.3, 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02704 2026-08-11 cs.CL 版本更新 79%

InfMem: Learning System-2 Memory Control for Long-Context Agent

InfMem: 面向长上下文智能体的系统2记忆控制

Xinyu Wang, Mingze Li, Peng Lu, Xiao-Wen Chang, Lifeng Shang, Jinping Li, Fei Mi, Prasanna Parthasarathi, Yufei Cui

机构 * McGill University(麦吉尔大学) Noah's Ark Lab(诺亚实验室)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 InfMem通过预思考-检索-写作协议实现系统2风格的控制,有效提升超长文档推理的准确率并减少推理时间。

Comments Accepted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07527 2026-08-11 cs.CL cs.AI 新提交 79%

DocAtlas: Long-Document Understanding as Mutable-State Interaction

DocAtlas:将长文档理解视为可变状态交互

Hongchen Wei, Yuanzhe Wang, Bei Liu, Yifan Yang, Qi Dai, Kai Qiu, Yunsheng Li, Dongdong Chen, Chong Luo, Zhenzhong Chen, Baining Guo

专题命中 记忆与上下文管理 :agent(abstract);tool use(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 本研究提出DocAtlas系统,将长文档理解视为可变状态交互,通过可变文档工具结合自改进检索等技术,在MMLongBench-Doc上用GPT-5.4达71.4%,还可提升紧凑型VLM智能体性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07810 2026-08-11 cs.MA cs.SI 新提交 78%

Mobility, Memory, and Network Structure in Agent-Based Models of Convention Tipping and Convergence

基于智能体的惯例颠覆与收敛模型中的流动性、记忆与网络结构

Joe Shymanski, Garrick Springer, Sandip Sen

专题命中 记忆与上下文管理 :agent(title,abstract)

AI总结 该研究构建智能体基模型,探究流动性、记忆、网络拓扑对惯例颠覆阈值的影响,发现多数配置下颠覆必然发生,还建立预测模型估计收敛时间,拓展了经典颠覆点研究。

Comments Under review at the Journal of Artificial Societies and Social Simulation (JASSS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08859 2026-08-11 cs.LG cs.AI 新提交 76%

Agentic Anomaly Detection with ORCA-Style Dynamic Inductive Bias Adaptation in Multimodal Wearable Time Series Data

基于ORCA风格动态归纳偏差自适应的多模态可穿戴时间序列智能体异常检测

Anushka Roy, Jyotirmoy Singh, Shreea Bose, Chittaranjan Hota

机构 * BITS Pilani(皮尔尼理工学院)

专题命中 记忆与上下文管理 :agentic(title);分类 cs.AI、cs.LG

AI总结 该研究针对资源受限的非平稳生理时间序列异常检测问题,提出ORCA框架,通过监督控制器动态调整时间感受野,在WBAN和MIMIC-IV数据集上实现稳健性能,无需预调时间范围。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07622 2026-08-11 cs.AI cs.IR cs.LG 新提交 73%

Controlled Memory Interference in Continual LLM Agents

持续大型语言模型智能体中的可控记忆干扰

Ao Ding, Hongzong LI, Shiqin Tang, Li Zhang, Liang Chen, Xuyang Chen, Zi Liang

机构 * China University of Geosciences (Beijing)(中国地质大学(北京)) Northwestern Polytechnical University(西北工业大学) The Hong Kong University of Science and Technology(香港科技大学) Chinese Academy of Sciences(中国科学院) The Hong Kong Polytechnic University(香港理工大学) École polytechnique fédérale de Lausanne(洛桑联邦理工学院) National University of Singapore(新加坡国立大学)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出可控记忆干扰(CMI)框架,揭示记忆进化受经验相互作用影响,为持续大型语言模型智能体的记忆系统提供诊断与学习方法,提升记忆更新区分度与任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08795 2026-08-11 cs.CR cs.CL 新提交 70%

Toward Metacognitive One-Shot Indirect Prompt Injection: Strategy Abstraction Via Outcome-Conditioned Reflection

迈向元认知少样本间接提示注入:基于结果条件反射的策略抽象

Sihan Hou, Xinmeng Hou, Zhijun Zhang, Zehao Wang, Xuhong Ren, Sibo Qin, Kuntharrgyal Khysru, Qing Guo

专题命中 记忆与上下文管理 :agent(abstract,abstract_cn);分类 cs.CL

AI总结 本文提出SAVOR方法,将攻击适配转向离线策略蒸馏,仅需一次目标智能体查询,在多基准与模型上攻击成功率显著优于现有方法,且记忆可跨防御迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08036 2026-08-11 cs.RO 新提交 67%

Compiling and Benchmarking Task-State Horizons for Embodied Agents

面向具身智能体的任务状态视界的编译与基准测试

Meiqi Wang, Shichao Li

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract)

AI总结 该研究定义任务状态视界(TSH),推出RoboGraph编译器并发布含588个情节的基准,发现多数先进智能体模型在高TSH下维护、更新任务相关状态存在差距。

Comments 32 pages, including appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06257 2026-08-11 cs.CV cs.HC 版本更新 67%

MASS: Multiplayer World Models with Authoritative Shared State

MASS:具有权威共享状态的多人世界模型

Ziqi Cai, Siqi Yang, Yimu Wang, Zixian Gao, Yunheng Liu, Shuchen Weng, Erwin Wu, Kaipeng Zhang, Boxin Shi

机构 * Alaya Lab(Alaya实验室) Peking University(北京大学) Institute of Science Tokyo(东京科学大学)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract)

AI总结 该研究提出MASS模型,通过将世界动态与视图渲染解耦,解决现有视频世界模型在多人环境中的缺陷,在多人Snake基准测试中实现更优状态精度,为多智能体世界模拟提供实用基础。

Comments Project Page: https://alaya-lab.github.io/MASS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01952 2026-08-11 cs.CL cs.AI cs.LG 版本更新 67%

WebChoreArena: Evaluating Web Browsing Agents on Realistic Tedious Web Tasks

WebChoreArena:在现实繁琐网页任务上评估网页浏览智能体

Atsuyuki Miyai, Zaiying Zhao, Kazuki Egashira, Atsuki Sato, Tatsumi Sunada, Shota Onohara, Hiromasa Yamanishi, Mashiro Toyooka, Kunato Nishina, Ryoma Maeda, Kiyoharu Aizawa, Toshihiko Yamasaki

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出WebChoreArena,作为WebArena的扩展,包含532个耗时300多小时开发的繁琐网页任务,从大规模记忆、计算、长期记忆三维度评估网页浏览智能体,实验显示其能清晰衡量LLM进展且难度高于WebArena。

Comments COLM2026. Project Page: https://webchorearena.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07663 2026-08-11 cs.CV cs.AI cs.CL 新提交 62%

Keep It Simple: Multi-Key Episodic Memory Retrieval for Ultra-Long Video Understanding

保持简洁:用于超长视频理解的多键情景记忆检索

Yeeun Choi, Youngbeom Yoo, Joon-Young Lee, Hyolim Kang, Seon Joo Kim

机构 * Yonsei University(延世大学) Adobe Research(奥多比研究院)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 针对超长视频理解的两阶段范式需求,提出MERIT框架,通过多键表示与按需时间扩展实现精准检索,在三个长视频基准数据集上取得最优性能。

Comments Accepted to ECCV 2026 (Oral). Project Page: https://choi-yeeun.github.io/MERIT/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09480 2026-08-11 cs.AI 新提交 57%

From Prompt to Harness: Coderlet from Scratch

从提示到管控:从零开始构建Coderlet

Mengfan Li

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文研究了一种紧凑的编程智能体管控设计,通过模型、执行、状态边界连接各组件,实现模型生成到环境动作的转换,可逐步优化并在可执行工件中实现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07915 2026-08-11 cs.LG 新提交 57%

SPECTRA: Pushing the KV Cache Beyond the 2-Bit Cliff via Spectral Transform Coding

SPECTRA:通过谱变换编码将KV缓存推向2比特极限之外

Jiamu Zhang, Liang Wu, Kelly Wan, Hanjie Chen, Liangjie Hong

机构 * Nokia(诺基亚) Rice University(莱斯大学)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.LG

AI总结 SPECTRA是一种无需训练的KV缓存压缩编解码器,通过谱变换编码将比特预算集中于关键通道,在Llama-3.1-8B等模型上实现最高12倍压缩,突破2比特极限,提升长上下文处理能力

Comments 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13884 2026-08-11 cs.AI 版本更新 57%

Experience Memory Graph: One-Shot Error Correction for Agents

经验记忆图:智能体的一次性错误纠正

Wenjun Wang, Yuchen Fang, Fengrui Liu, Zibo Liang, Kai Zheng

机构 * University of Electronic Science and Technology of China(电子科技大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 研究针对大语言模型智能体在复杂任务中易出错且难恢复的问题,提出经验记忆图框架,将失败恢复转化为图匹配问题,训练时提取相关子图和路径存储,测试时指导智能体,实验证明其性能优于现有基线且无需测试时反复试验。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08482 2026-08-11 cs.DC 新提交 50%

FlashBoot: Sub-Second Weight Loading for Large Models at Rack Scale

FlashBoot:机架级大模型的亚秒级权重加载方案

Issac Zhu, Hscos Zhang, Keith Jiang, Jack Li, Hugh Yin, Jason Zhao

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 FlashBoot是基于SGLang设计的机架级大模型权重加载子系统,通过FabricArena布局等技术解决现有方案的结构性缺陷,将单节点及机架级权重加载速度大幅提升,性能远超现有最先进方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09661 2026-08-11 quant-ph cs.ET 新提交 50%

Memory-, Circuit-, and Ansatz-Efficient VQLS for CFD on Hybrid Quantum-HPC Systems

面向混合量子-高性能计算系统的、内存、电路与本征态拟设高效的变分量子线性求解器(VQLS)用于计算流体动力学(CFD)

Chao Lu, Muralikrishnan Gopalakrishnan Meena, Eduardo Antonio Coello Perez, Kalyana Chakravarthi Gottiparthi, Seongmin Kim

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 本研究针对混合量子-HPC系统上VQLS用于CFD的三大挑战,通过基准测试编码策略、评估本征态拟设、在Frontier超算部署工作流,建立了实用基线并明确了更大规模问题的瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00729 2026-08-11 econ.TH 版本更新 50%

On the Sparsity of Optimal Information Structures

论最优信息结构的稀疏性

Masaki Miyashita

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究最优信息结构的稀疏性,通过线性规划方法发现其稀疏特性,并在含网络效应的创新采用问题中验证,高状态下确定性推荐全采用,低状态下随机化嵌套行动组合以最大化采用者数量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19381 2026-08-11 quant-ph cond-mat.dis-nn 版本更新 50%

A calibrated diagnostic for reverse-anneal sampling in programmable quantum annealers

子系统弛豫和一种校准的采样诊断方法用于可编程量子退火机

Luis Lozano

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 本文研究了可编程量子退火机中子系统弛豫现象,并提出了一种校准的采样诊断方法,用于评估量子退火机的采样性能和记忆保持能力。

Comments v2: substantially revised: title and framing updated, benchmarking section removed following a reproducibility audit, claims narrowed; reformatted to revtex4-2 (11 pages, 5 figures + supplemental material as ancillary file). All remaining results regenerate from the deposited raw data

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11603 2026-08-11 quant-ph physics.chem-ph 版本更新 50%

Dissipative continuation for ground-state preparation at chemical transition states

在化学转变态上快速耗散基态制备

Thomas W. Watts, Soumya Sarkar, Daniel Collins, Nam Nguyen, Luke Quezada, Michael J. Bremner, Samuel J. Elman

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 该研究提出了一种利用反应路径作为计算原语的耗散基态制备协议,通过Procrustes对齐轨道旋转和工程化耗散冷却,在强相关区域中以~O(N_o^3/ε_E)的复杂度制备化学系统基态。

Comments 15 + 13 pages, 4+1 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09672 2026-08-11 physics.acc-ph 50%

X-ray reflection: a FLUKA model and its application in the design of synchrotron light beamlines and CERN's Future Circular Collider

X射线反射:FLUKA模型及其在同步辐射光束线和CERN未来圆形对撞机设计中的应用

Giuseppe Mazzola, Sunil Chitra, Arnaud Devienne, Alessandro Frasca, María José García Fusté, Dominique Heinis, Anton Lechner, Giuseppe Lerner, Luca Rebuffi, Manuel Sanchez del Rio, David L. Windt, Eugeni Graugés, Francesc Salvat Pujol

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 FLUKA开发了X射线反射模型,用于同步辐射光束线和CERN未来圆形对撞机设计,实现了复杂模拟的一站式处理。

Comments 14 pages, 17 figures, to be published

详情

展开后加载摘要…

URL PDF HTML 收藏