arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-30 至 2026-07-30 共收录 17 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 17 篇

2607.26953 2026-07-30 cs.NI 新提交 85%

Assurance-Scoped Reliability for Agentic Networks: Capturing the State That Matters

智能体网络的保障范围型可靠性:捕获关键状态

Bilgehan Erman, Andrea Francini, Nikos Papadis

专题命中 记忆与上下文管理 :agentic(title,abstract);tool use(abstract);planning(abstract)

AI总结 针对智能体网络的传统可靠性措施无法覆盖的失效模式,提出Reliability Assurance Intelligence架构,通过服务可靠性配置文件和上下文胶囊保障服务可靠性与问责性,以确定性网络服务为例验证该架构。

Comments 7 pages, 4 figures, 2 tables, 15 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02259 2026-07-30 cs.CL cs.AI cs.LG 版本更新 85%

MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent

MemAgent:基于多轮对话强化学习的记忆智能体重构长上下文大语言模型

Hongli Yu, Tinghong Chen, Jiangtao Feng, Jiangjie Chen, Weinan Dai, Qiying Yu, Ya-Qin Zhang, Wei-Ying Ma, Jingjing Liu, Mingxuan Wang, Hao Zhou

机构 * ByteDance Seed(字节跳动种子期) Institute for AI Industry Research (AIR)(人工智能产业研究院) Tsinghua University(清华大学)

专题命中 记忆与上下文管理 :agent(title,abstract);workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 该研究提出MemAgent智能体工作流,结合扩展的DAPO算法优化长文本任务,实现从8K到3.5M上下文的高效外推,在RULER测试中表现优异。

Comments Accepted to ICLR 2026 as an Oral presentation. OpenReview: https://openreview.net/forum?id=k5nIOvYGCL Project page: https://memagent-sialab.github.io/

Journal ref International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26520 2026-07-30 cs.DB cs.AI cs.IR 新提交 83%

A Graph-Native Bitemporal Memory Store for Conversational AI Agents

面向对话式AI智能体的原生图双时态内存存储

Alp Niksarli, Gopesh Baheti

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 该研究针对对话式AI智能体跨会话持久内存缺失的问题,提出原生图双时态内存存储方案,经LongMemEval基准测试,在知识更新等任务上取得良好效果,为纯检索的局限性提供了改进方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26410 2026-07-30 cs.CL cs.AI cs.SD eess.AS 新提交 81%

Voice Memory for Agentic Speech Recognition

面向智能体语音识别的语音记忆

Chao-Han Huck Yang, Zih-Ching Chen, Piotr Zelasko, Zhehuai Chen, Jagadeesh Balam, Boris Ginsburg

机构 * NVIDIA(英伟达)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 该研究提出仅推理方案Voice Memory,通过听者-思考者架构克制过度校正,在10个HyPoradise域上将加权词错误率降至7.52%,可跨校正器迁移且不增加推理参数。

Comments Preprint. Technical report and open source: https://huggingface.co/huckiyang/voice-memory

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27080 2026-07-30 cs.CR cs.AI 新提交 79%

MemSecBench: Tracking Agent Memory Poisoning from Persistence to Consequence and Repair

MemSecBench:追踪智能体内存中毒从持久性到后果及修复的全生命周期

Xuanze Chen, Xukang Xie, Wentao Fu, Jiajun Zhou, Shanqing Yu, Qi Xuan

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本研究提出MemSecBench基准测试,通过24种配置的实验发现不同内存系统栈在智能体内存中毒的持久性、后果及选择性修复上存在显著差异,为智能体内存安全评估提供了工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26072 2026-07-30 cs.IR cs.AI 新提交 72%

IFCMemoryBench: Evaluating Long-Term Memory of LLM-Based Agents in BIM Information Retrieval

IFCMemoryBench:评估基于大语言模型(LLM)的智能体在建筑信息模型(BIM)信息检索中的长期记忆能力

Changyu Du, Alexander Vosseler, Filippo Mazza, André Borrmann

专题命中 记忆与上下文管理 :agent(abstract);workflow(abstract);分类 cs.AI;agentic(comments)

AI总结 本文推出IFCMemoryBench基准,评估基于LLM的智能体在BIM信息检索中的长期记忆,发现现有通用记忆系统在该场景下表现差,存在领域迁移差距。

Comments KDD 2026 Workshop on Evaluation and Trustworthiness of Agentic AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26475 2026-07-30 cs.DC 新提交 67%

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch

DualDecoder:通过预测预取加速长上下文大语言模型推理

Zuning Liang, Zhiyi Yao, Qi Chen, Yuedong Xu, Hao Dai, Zhiqiang Ding, Tongkai Yang, Jinlong Hou, Yuan Cheng

专题命中 记忆与上下文管理 :agentic(abstract,abstract_cn)

AI总结 该研究针对长上下文LLM推理的内存墙瓶颈,提出轻量级服务系统DualDecoder,通过双token解码流水线预测预取关键KV条目,消除辅助状态开销,使解码吞吐量最高提升2.62倍且保留延迟与模型质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26637 2026-07-30 cs.CL cs.AI 新提交 62%

Filesystem-Based Memory for LLM Agents: Organization, Evolution, and Sustainability

面向LLM智能体的基于文件系统的内存:组织、演化与可持续性

Sizhe Zhou, Sheldon Yu, Hui Wei, Junda Wu, Siru Ouyang, Yizhu Jiao, Shijia Pan, Julian McAuley, Yu Zhang, Tong Yu, Jiawei Han

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of California, San Diego(加利福尼亚大学圣迭戈分校) University of California, Merced(加利福尼亚大学默塞德分校) Adobe Research(奥多比研究院) Texas A&M University(德克萨斯农工大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本研究首次系统探索面向LLM智能体的基于文件系统的内存,定义三个智能体角色开展实验,发现有组织存储可减半检索成本,但多数智能体组织会退化,工具集对存储形态的影响与更换模型相当,将文件系统设为智能体内存的设计空间。

Comments 59 pages, 12 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16986 2026-07-30 cs.CL cs.AI 版本更新 62%

Skills on the Fly: Test-Time Adaptive Skill Synthesis for LLM Agents

Skills on the Fly: Test-Time Adaptive Skill Synthesis for LLM Agents

Jingxing Wang, Chenyu Zhou, Zhihui Fu, Jun Wang, Weiwen Liu, Weinan Zhang, Jianghao Lin

机构 * Shanghai Jiao Tong University(上海交通大学) OPPO Research Institute(OPPO研究院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出了一种在测试时自适应的技能合成方法SkillTTA,通过检索与当前任务相关的少量训练轨迹并将其合成成为任务特定的文本技能,以提高LLM代理在SpreadsheetBench、ALFWorld和BigCodeBench等任务上的性能。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27132 2026-07-30 cs.LG 新提交 57%

Minimal Markovization via Stable Quotients in Holonomy-Cover Decision Processes

完整覆盖决策过程中通过稳定商实现的最小马尔可夫化

Zuyuan Zhang, Yongshan Chen, Mahdi Imani, Tian Lan

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本文针对结构化POMDP类刻画最小马尔可夫充分统计量,构造稳定商实现精确有限马尔可夫状态,提出完整记忆强化学习方法,实验验证其压缩与决策性能优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26827 2026-07-30 cs.HC cs.AI 新提交 57%

AI as Friction for Reflection Support in Ideation

生成式AI作为创意构思中反思支持的阻力来源

Janin Koch, Xiaohan Liao, Géry Casiez

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文提出设计构思中AI应作为反思支持的阻力主体,而非促进输出的顺滑主体,其核心作用是支持设计师构建和承载创意依据。

Comments In Proceedings of The First Reflection in Creative Experience (RiCE) Workshop (RiCE W1) arXiv:2607.24558

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26587 2026-07-30 cs.MA cs.AI 新提交 57%

One Run Is Not an Idea: The Implementation Lottery in Automated Research

一次运行并非一个想法:自动化研究中的实施彩票

Jingjie Ning, Shanshan Zhong, Xiaochuan Li, Ji Zeng, Chenyan Xiong

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 该研究针对自动化研究中存在的“实施彩票”问题,提出想法可靠性审计方法,通过312次分配实验发现实施方差远大于成果重运行方差,表明需多实施证据支撑想法决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25379 2026-07-30 cs.CL 版本更新 57%

StateRAG: Typed State Contracts for Complex Retrieval-Augmented Generation

EfficientGraph-RAG:面向跨任务检索增强生成的结构化检索状态管理

Miaohe Niu, Pengxiang Li, Jingbo Zhu, Tong Xiao

机构 * School of Computer Science and Engineering, Northeastern University, China(东北大学计算机科学与工程学院) Tsinghua University, China(清华大学) Kunming University of Science and Technology, China(昆明理工大学) NiuTrans Research, Shenyang, China(沈阳NiuTrans研究院)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.CL

AI总结 提出EfficientGraph-RAG框架,通过显式定义检索状态(TAM、MARS、SMP三个机制)实现结构化状态管理,在多个基准上提升答案质量并降低大模型token消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26633 2026-07-30 cs.AR 新提交 50%

NELSSA: A GPU-PNM Heterogeneous System for Mixed-Length LLM Serving via Length-based Request Placement

NELSSA:一种基于GPU-PNM异构系统的LLM混合长度服务框架,通过基于长度的请求放置实现

Sookyung Choi, Seungyong Lee, Kangkyu Park, Yunseo Chun, Junseok Lee, Hyeongseok Gwak, Myunghyun Rhee, Euiseok Kim, Donguk Moon, Kwangsik Shin, Guseul Heo, Youngpyo Joo, Hoshik Kim, Jongse Park

专题命中 记忆与上下文管理 :agentic(abstract)

AI总结 NELSSA是集成GPU与PNM加速器的LLM服务系统,通过基于长度的请求放置处理混合长度工作负载,解码吞吐量最高提升5.5倍,P99延迟最高降低15倍,为LLM基础设施提供新范式。

Comments 14 pages, 19 figures. Accepted to the 59th IEEE/ACM International Symposium on Microarchitecture (MICRO 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27199 2026-07-30 math.CO 新提交 50%

Settling the Optimal Exponent Relating Sumsets and Difference Sets

确定与和集及差集相关的最优指数

Haowei Lin, Shanda Li

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 该研究解决了阿贝尔群有限子集的和差不等式中指数最优性的公开问题,构造集族证明第一个不等式的指数1/2最优,相关工作借助AI智能体Hyra完成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26407 2026-07-30 math.OC 新提交 50%

Scalable Dynamic Optimal Transport via Distributed Linearized ADMM

基于分布式线性化交替方向乘子法的可扩展动态最优传输

Hari Dahal, Rongjie Lai, Yangyang Xu

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文针对动态最优传输数值求解的不稳定与内存开销大问题,提出结合线性化交替方向乘子法的重构方案与分布式变量划分方法,通过实验验证了方法的稳定性、鲁棒性与可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24065 2026-07-30 eess.SY cs.SY 版本更新 50%

The Art of of Resilient Substation Design for 500 Year Storm Events Current State of the Art and Challenges for Floodplain Management and Infrastructure Hardening

面向500年一遇风暴事件的弹性变电站设计:洪泛区管理与基础设施加固的现状与挑战

Chinmay Shetty, Soham Ghosh

专题命中 记忆与上下文管理 :planning(abstract)

AI总结 本文提出一个综合工程框架,通过场地抬升、土壤稳定、铰接式混凝土块护坡和绿色基础设施,提升变电站对500年一遇洪水事件的弹性,降低生命周期成本。

Comments 18 pages, 6 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏