arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-05 至 2026-08-05 共收录 18 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 18 篇

2608.03214 2026-08-05 cs.AI 新提交 90%

The Agent Operating System (AOS): A Reference Operating Architecture for Distributed Agentic Systems

智能体操作系统(AOS):分布式智能体系统的参考操作架构

Ankur Sharma, Deep Shah

专题命中 记忆与上下文管理 :agent(title,abstract);agentic(title,abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出智能体操作系统(AOS),作为分布式智能体系统的参考操作架构,用于管控异构组件以构建可管控、可靠、可观测且互操作的智能体系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03800 2026-08-05 cs.CY cs.AI cs.SI 新提交 87%

Autoreflection: How Agentic Strange Loops Turn Human Culture into AI Infrastructure

自反:智能体的奇异循环如何将人类文化转化为AI基础设施

Holly Lewis

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract,comments);AI agent(abstract,comments);分类 cs.AI

AI总结 本文提出自反概念,以LLM智能体为研究对象,通过Moltbook平台案例验证其行为标准,发现智能体将人类文化转化为自身AI基础设施。

Comments 35 pages. Also available at https://philarchive.org/rec/LEWAHA. Keywords: autoreflection, AI agents, agentic AI, LLM agents, generative agents, large language models, multi-agent systems, agent societies, Moltbook, OpenClaw, situational awareness, in-context learning, philosophy of mind, emergent behavior, computational social science, identity, memory

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03062 2026-08-05 cs.AI cs.GR cs.SE 新提交 81%

TraceCAD: Trace-Guided Repair for Agentic CAD Generation

TraceCAD:面向智能体CAD生成的轨迹引导修复

Fengxiao Fan, Jingzhe Ni, Fan Sang, Xiaolong Yin, Yu Liu, Ruofeng Tong, Min Tang, Peng Du

专题命中 记忆与上下文管理 :agentic(title);agent(abstract);分类 cs.AI、cs.SE

AI总结 TraceCAD是一种用于智能体CAD生成的轨迹引导修复方法,通过引入持久状态等机制提升了CAD生成的几何质量与修复可靠性,在DeepCAD基准测试中取得了良好效果。

Comments 18 pages, 7 figures; includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02843 2026-08-05 cs.CR cs.AI 新提交 79%

MutMem: Cryptographically Authorized Mutation in Persistent Agent Memory

MutMem:持久智能体内存中的密码学授权突变

Walid Saidi

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本研究针对持久智能体内存的授权与防篡改问题,提出HOM-AIMOS中的MutMem协议,经实验验证其在多个基准任务中表现良好,可有效抵御中毒攻击。

Comments https://github.com/wallidsaydi-creator/HOM-AIMOS. 32 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03979 2026-08-05 cs.CV cs.AI 新提交 74%

Video-DeepResearch: Towards the Next-Generation Multimodal Deepresearch Agent

Video-DeepResearch:迈向新一代多模态深度研究智能体

Zhen Fang, Yu Zeng, Wenxuan Huang, Yiming Zhao, Shiting Huang, Tianfei Ren, Qi Lu, Qingnan Ren, Qisheng Su, Lionel Z. Wang, Qingyu Yin, Shuang Chen, Zehui Chen, Lin Chen, Zhenfei Yin, Yao Hu, Shaohui Lin, Wanli Ouyang, Shaosheng Cao, Feng Zhao

专题命中 记忆与上下文管理 :agent(title);分类 cs.AI

AI总结 该研究提出Video-DR智能体框架,通过解耦感知-探索流水线与分阶段工具解锁解决现有多模态模型的模态偏差和知识泄漏问题,构建基准并在视频问答任务上取得SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26760 2026-08-05 cs.CL cs.LG 版本更新 73%

Metis: Memory Foundation Model

Metis:记忆基础模型

Zeyu Zhang, Ziliang Guo, Yihang Sun, Xichong Zhang, Xixuan Hao, Zehao Lin, Yang Zhang, Xiaoyan Zhao, Tong Shen, Bo Tang, Zhi-Qin John Xu, Junchi Yan, Haofen Wang, Xu Chen, Feiyu Xiong, Zhiyu Li, Tat-Seng Chua

机构 * MemTensor (Shanghai) Technology Co., Ltd.(墨芯(上海)科技有限公司) Renmin University of China(中国人民大学) National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学) Tongji University(同济大学)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.CL、cs.LG

AI总结 该研究提出首个记忆基础模型原型Metis,赋予基础模型原生记忆能力,通过新架构与优化目标实现,经实验验证其具备原生记忆能力并发布相关资源。

Comments 46 pages, 11 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03555 2026-08-05 cs.AR 新提交 67%

Heterogeneous LLM Serving with General-Purpose Processing-Near-Memory for Retrieval-Based Sparse Attention

面向基于检索的稀疏注意力的通用近内存处理异构大语言模型服务

Hyungkyu Ham, Junhyeong Bae, Seungheon Lee, Myeongjae Jeon, Gwangsun Kim

专题命中 记忆与上下文管理 :agentic(abstract,abstract_cn)

AI总结 本文针对前沿LLM的基于检索的稀疏注意力需求,提出异构解码服务系统KARAT,结合PNM与OFMS、CMR优化,大幅提升吞吐量与每TDP性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03048 2026-08-05 cs.CL cs.AI 新提交 62%

PI-Mem: Pushing Long-Context Reasoning to 3.6M Tokens with Parallel-Iterative Memory

PI-Mem:通过并行迭代式记忆将长上下文推理推向360万 tokens

Dawei Liu, Haixu Song, Shuang Cheng, Shijie Wang, Haozheng Hou, Kaifeng Liu, Ermo Hua, Zhonghang Yuan, Zhijie Zhong, Yuchen Fan, Biqing Qi, Bowen Zhou

专题命中 记忆与上下文管理 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 该研究提出PI-Mem并行迭代记忆机制,在360万 tokens长上下文下,使Qwen系列模型在HotpotQA基准上较循环记忆基线实现准确率提升与推理加速,打破长上下文推理的准确率-效率权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03420 2026-08-05 cs.AI 新提交 61%

Towards Improving Sequential Decision-Making in LLM Agents via Experience Memory

基于经验记忆提升大语言模型智能体的序列决策能力

Jakub Rada, Viliam Lisý

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI;autonomous agent(comments)

AI总结 本研究针对LLM智能体序列决策性能不足的问题,提出带经验记忆的智能体框架,通过对局后反思与规则提取,在不修改模型权重的情况下提升了井字棋任务的表现。

Comments 8 pages, 6 figures, 14 tables, 5 appendices, accepted at Neuro-Symbolic Intelligence for LLMs and Autonomous Agents workshop at IJCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02713 2026-08-05 cs.CV cs.AI cs.RO 新提交 61%

Quo Vadis, World Modeling?

世界建模,何去何从?

Yu Yang, Xuemeng Yang, Licheng Wen, Lingdong Kong, Xiaobin Hu, Dongyue Lu, Wei Chow, Xiyan Huang, Yuxiang Feng, Yue Liao, Jianbiao Mei, Daocheng Fu, Rong Wu, Pinlong Cai, Ran Yi, Ying Tai, Jiangning Zhang, Botian Shi, Yong Liu, Shuicheng Yan

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI;agentic(comments)

AI总结 本研究提出以智能体为中心的交互式世界代理,将世界建模范式从物理状态转换转向智能体可用信息转换,划分六种代理类型与三个赋能层面,为构建赋能智能体的世界代理建立路线图。

Comments Technical Blog at https://worldbench.github.io/awesome-agentic-world-model GitHub Repo at https://github.com/worldbench/awesome-agentic-world-model

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03844 2026-08-05 cs.AI 新提交 57%

MAFIA: Query-Only Memory Attacks via Probing and Factual Injection against Audited LLM Agents

MAFIA:针对经审计的大语言模型智能体的、基于探测与事实注入的仅查询内存攻击

Jiaming Chen, Yisen Gao, Yanping Li, Zifan Liu, Yumeng Zhang, Jun Zhang

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI

AI总结 本研究针对经审计的LLM智能体,提出MAFIA攻击框架,通过放置策略与伪装有效载荷实现高攻击成功率,大幅降低审计检测率,揭示智能体内存系统的关键漏洞。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03007 2026-08-05 cs.SE 新提交 57%

The Ground Is Shifting: A Reflection on the Foundations of Software Measurement

基础正在转变:软件测量基础的反思

Thomas Bock, Audris Mockus, Bogdan Vasilescu

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.SE

AI总结 本文反思软件测量的基础,指出AI智能体使用工具产生的轨迹违背了原始假设,提出开展AI辅助复现计划以开发适应当前数据的有效方法,维持软件测量的相关性。

Comments Accepted to the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE '26) $\unicode{0x000A}$ DOI: https://doi.org/10.1145/3832783.3834553

Journal ref Proceedings of the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE '26), October 2026, Munich, Germany. ACM

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01679 2026-08-05 cs.AI 版本更新 57%

When Memory Becomes Authority: Benchmarking Authority Collapse at the Memory Consolidation Boundary

当记忆成为权威:在记忆整合边界处对权威崩溃进行基准测试

Qiuyang Zhan, Rui Zhang, Sheng Guo, Lepeng Zhao, Zhuotao Liu

机构 * Tsinghua University(清华大学) East China Normal University(华东师范大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本研究推出AuthMem-Bench基准,发现智能体记忆整合存在权威崩溃问题,自动保留权威标签可大幅降低未授权动作率,证明记忆适配需同时保留权威信息。

Comments 38 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03836 2026-08-05 cs.LG 版本更新 57%

Enhancing Q-Value Updates in Deep Q-Learning via Successor-State Prediction

通过后继状态预测增强深度Q学习中的Q值更新

Lipeng Zu, Hansong Zhou, Xiaonan Zhang

机构 * Department of Computer Science(计算机科学系) Florida State University(佛罗里达州立大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本文针对DQN更新方差高的问题,提出SADQ算法,通过建模环境动态融入后继状态分布实现更稳定的价值更新,实验显示其在基准及现实任务中优于DQN变体。

Comments Withdrawn by the authors because the presentation of the proposed method requires substantial revision, the theoretical analysis is incomplete, and the experimental validation is insufficient to support the main claims

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03051 2026-08-05 cs.RO cs.DC cs.SY eess.SY 新提交 50%

CUDA MPC: A GPU-Native Solver for Model Predictive Control

CUDA MPC:一款面向模型预测控制的GPU原生求解器

Babak Akbari, Melissa Greeff

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出GPU原生MPC框架CUDA MPC,通过协同设计优化算法等实现低开销,在多机器人基准测试中实时性远超CPU及同类框架,是首个实现10智能体集群无碰撞协调的实时求解器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26327 2026-08-05 econ.TH 版本更新 50%

The Last Costly Signal: How Generative AI Collapses Competence Signaling and Why Liability Sustains Markets for Expert Services

最后一个高成本信号:生成式AI如何瓦解能力信号机制,以及为何责任机制能维持专家服务市场

Andreas Bauer

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究生成式AI降低专家服务信号成本导致的市场混同问题,提出结果依赖型责任信号可恢复市场分离,还内生化合同制度并设计了相关验证实验。

Comments 26 pages, 7 figures. JEL codes: D82, D86, L15, L84, M31, O33. Simulation code and numerical results available at: https://doi.org/10.6084/m9.figshare.33106946

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25588 2026-08-05 cs.IT cs.SY eess.SY math.IT 版本更新 50%

System-Aware Adaptive CSI Feedback via RL-Guided Autoencoder Switching in Multi-User MIMO System

多用户MIMO系统中基于RL引导的自动编码器切换的系统感知自适应CSI反馈

Maryam Ansarifard, Mohit K. Sharma, George Exarchakos, Kishor C. Joshi

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 针对mMIMO系统中信道状态信息反馈问题,提出基于强化学习驱动控制框架,在预训练多速率自动编码器组上运行,依信道条件和性能指标选压缩率,引入系统感知奖励公式,相比传统方案提升频谱和反馈效率,降低反馈成本等。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13706 2026-08-05 cs.CV 50%

ParkingTwin: Training-Free Streaming 3D Reconstruction for Parking-Lot Digital Twins

ParkingTwin: 无需训练的实时停车区三维重建

Xinhao Liu, Yu Wang, Xiansheng Guo, Gordon Owusu Boateng, Yu Cao, Haonan Si, Xingchen Guo, Nirwan Ansari

机构 * School of Information and Communication Engineering, University of Electronic Science and Technology of China(信息与通信工程学院,电子科学与技术大学) Department of Communications and Networking, Xi'an Jiaotong-Liverpool University(通信与网络系,西安交通大学利物浦大学) School of Electrical Engineering, Hebei University of Technology(电气工程学院,河北工业大学) Advanced Networking Lab., Department of Electrical and Computer Engineering, New Jersey Institute of Technology(高级网络实验室,电气与计算机工程系,新泽西理工学院)

专题命中 记忆与上下文管理 :planning(abstract)

AI总结 ParkingTwin通过无需训练的轻量级系统实现停车区实时三维重建,利用OSM拓扑生成一致TSDF,实时过滤动态遮挡,并在CIELAB中鲁棒融合光照,提升重建精度和效率。

Comments 35 pages, 10 figures. Submitted to ISPRS Journal of Photogrammetry and Remote Sensing. Under review

Journal ref ISPRS Journal of Photogrammetry and Remote Sensing 240 (2026) 114-129

详情

展开后加载摘要…

URL PDF HTML 收藏