arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-17 至 2026-08-17 共收录 13 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 13 篇

2608.14352 2026-08-17 cs.SE cs.LG 新提交 88%

ATLAS: Discovering Agent Strategies through LLM-Guided Abstraction and Automata Learning

ATLAS:通过大语言模型引导的抽象与自动机学习发现智能体策略

Ignacio D. Lopez-Miguel, Andreas Happe, Jürgen Cito, Ezio Bartocci, Bettina Könighofer, Martin Tappler

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(abstract);agentic(abstract);分类 cs.LG、cs.SE

AI总结 该研究提出ATLAS方法,结合轨迹抽象与自动机学习从智能体轨迹推断有限状态模型,以实现对LLM智能体行为的可解释分析、知识迁移及简洁解释。

Comments 7 pages, accepted for publication at ACM/IEEE MODELS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13883 2026-08-17 cs.AI 新提交 83%

MemoryLake on MemoryArena: A Matched Study of Agent Memory Backends

基于MemoryArena的MemoryLake研究:智能体记忆后端的匹配对比

Chaoqun Zhan, Qiang Zhou, Guannan Li, Zhenqiang Huang, Qianjin Wang

机构 * MemoryLake Team(MemoryLake团队)

专题命中 记忆与上下文管理 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 该研究在MemoryArena的五个任务领域中,对比MemoryLake等三种智能体记忆后端,发现MemoryLake在数学等三个领域成功率最高,整体平均成功率领先,且性能与工作负载相关。

Comments 16 pages, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13833 2026-08-17 cs.IR cs.AI 新提交 79%

AdsWorldEngine: A Self-Evolving Conversational Advertising Agent through Orchestrator and Tool Coevolution

AdsWorldEngine:一种通过协调器与工具协同演化实现的自演进对话式广告智能体

Simiao Zuo, Chenhui Xu, Yimeng Jia, Qiang Lou, Jian Jiao, Denis Charles

专题命中 记忆与上下文管理 :agent(title);agentic(abstract);分类 cs.AI

AI总结 该研究提出AdsWorldEngine对话式广告框架,通过协调器与工具协同演化的自改进循环,结合机会门、评估器及基于标签的判断建模,在离线与在线实验中均显著提升广告性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13940 2026-08-17 cs.AI 新提交 70%

AI Research Preference Models

AI研究偏好模型

Thomas Simon Foster, Bassel Al Omari, Tingchen Fu, Thomas Mann, Carl Domond, Lucia Cipolina-Kun, Bhavul Gauri, Muna Aghamelu, Alexander D. Goldie, Eryk Helenowski, Jean-Christophe Gagnon-Audet, Alberto Pepe, Saba Nazir, Daniel Izcovich, Noam Levi, Rishi Hazra, Karen Hambardzumyan, Nicolas Baldwin, Xian Li, Martin Josifoski, Paris Giampouras, Masoud Jalili Sabet, Anya Sims, Hela Momand, Tatiana Shavrina, Despoina Magka, Jason Weston, Yulin Wang, Anirudh Goyal, João Henriques, Yoram Bachrach, Emily McMilin, Jakob Nicolaus Foerster

机构 * FAIR at Meta University of Oxford(牛津大学) University College London(伦敦大学学院)

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 该研究针对AI研究智能体的候选方案评估成本过高问题,提出AI研究偏好模型,将其集成到AIRA-dojo智能体后提升了基准任务性能,且达到目标性能的时间更短、预算更少。

Comments 34 pages, 17 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13987 2026-08-17 cs.AI cs.LG 新提交 62%

Nanbeige4.2-3B on Apple Silicon: Fixing Deployment Bugs and Decreasing Looped Transformer Memory Overhead

Apple Silicon上的Nanbeige4.2-3B:修复部署漏洞并降低循环Transformer的内存开销

John T. Halloran

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 本研究针对Apple Silicon上的30亿参数智能体模型Nanbeige4.2-3B,修复其部署漏洞并提出分块预填充策略降低循环Transformer内存开销,使其在MCPMark等基准上完成智能体任务的比例提升至30%。

Comments 8 pages, 3 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29668 2026-08-17 cs.AI cs.CL 版本更新 62%

GRASP: Gated Regression-Aware Skill Proposer for Self-Improving LLM Agents

GRASP: 门控回归感知技能提议器用于自我改进的LLM智能体

Johannes Moll, Jean-Philippe Corbeil, Jiazhen Pan, Martin Hadamitzky, Daniel Rueckert, Lisa Adams, Keno Bressem

机构 * Technical University of Munich and TUM University Hospital(慕尼黑技术大学及慕尼黑大学医院) Microsoft Healthcare & Life Sciences(微软医疗与生命科学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

AI总结 提出GRASP方法,通过门控回归感知技能库编辑,在硬回归预算下确保每次技能更新带来净改进,显著提升LLM智能体在结构化环境中的操作可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14528 2026-08-17 cs.AI econ.EM math.ST stat.ME stat.ML 新提交 57%

Handover of In-Context Learning State Across Session Boundaries

跨会话边界的上下文学习状态移交

Masahiro Kato, Taka Kato

机构 * Mizuho-DL Financial Technology(瑞穗数字金融科技) the University of Tokyo(东京大学) RIKEN AIP(理化学研究所人工智能项目) Osaka Metropolitan University(大阪公立大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本研究针对大语言模型应用的会话移交问题,提出三部分记录方法,结合高斯线性与非参数回归,为移交的信息保留及记忆需求提供理论与方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14256 2026-08-17 q-fin.MF 新提交 50%

An ergodic theorem for multi-period mutual insurance

多期相互保险的遍历定理

John Armstrong

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 该论文针对存在异质性风险且无不可保险系统性风险的市场,证明多期相互保险的遍历定理,提出仅用短期合约即可实现极限效用的机制,可应用于风险分摊经济体及保险产品设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14421 2026-08-17 cs.CY 新提交 50%

Estimating the growth in emissions from AI data centres

估算AI数据中心的排放增长

Wim Vanderbauwhede

专题命中 记忆与上下文管理 :agentic(abstract)

AI总结 本研究采用先进生命周期评估模型,结合IEA与麦肯锡情景,量化AI数据中心扩张的排放,发现AI行业推崇的情景会使总排放大幅上升,隐含碳分量显著。

Comments 5 pages, 2 figures. Accepted at the 2nd International Workshop on Low Carbon Computing (LOCO 2026), Lancaster University, United Kingdom, 10-11 September 2026. Part of the LOCO 2026 proceedings, arXiv:LOCO2026/P05

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13763 2026-08-17 cs.LO math.LO 新提交 50%

Simplicial Semantics for Belief Revision

信念修正的单纯语义

Philip Sink

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文以《单纯复形中信念的一种语义》为基准修改信念语义,基于单纯模型节点为视角的概念提出两种信念修正形式化表述,并探讨迭代修正的概念陷阱及解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14398 2026-08-17 physics.soc-ph q-bio.PE 新提交 50%

Absorbing phase transition in a queueing model of coupled adaptive agents

耦合自适应智能体排队模型中的吸收相变

Alexei Vazquez

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 该研究构建耦合自适应智能体排队模型,揭示其存在不连续相变,得到临界度与最大群体规模,解释了人类联合/单独活动的决策机制及通信记录中的相关现象。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12122 2026-08-17 cs.RO 版本更新 50%

OctoSplat: Hybrid OctoMap-Gaussian Splatting for Active Semantic Mapping and Phenotyping with Horticultural Robots

利用高斯点云进行园艺环境的主动语义映射

Jose Cuaran, Naveen K. Uppalapati, Girish Chowdhary

机构 * the Siebel School of Computing and Data Science(塞比尔计算与数据科学学院) the Department of Agricultural and Biological Engineering(农业与生物工程系) National Center for Supercomputing Applications at University of Illinois, Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校国家超级计算中心)

专题命中 记忆与上下文管理 :planning(abstract)

AI总结 本文提出利用移动机械臂和高斯点云进行园艺环境主动3D重建,提升重建精度与效率,实现水果计数和体积估算。

Comments 23 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.01265 2026-08-17 cond-mat.stat-mech 版本更新 50%

Second law of thermodynamics at stopping times

停时的热力学第二定律

Izaak Neri

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 该研究针对介观系统终止于停时的过程建立热力学理论,给出类似热力学第二定律的功的界,并将其应用于聚合物拉伸、粒子逃离亚稳态的功的限定。

Comments 14 pages, 4 figures, the new version fixes some minor typographical errors

详情

展开后加载摘要…

URL PDF HTML 收藏