arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 6842 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 427 篇

2608.17347 2026-08-19 cs.LG cs.RO 新提交 57%

Repetition as Reinforcement: Enhancing Sample Efficiency via Instant Episode Repetition in Reinforcement Learning

重复作为强化:通过强化学习中的即时回合重复提升样本效率

Hoda Yamani, Yuning Xing, Koen van Rijnsoever, Bruce A. MacDonald, Henry Williams

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 受人类学习的重复机制启发,提出即时回合重复(IER)机制,将其集成至 SAC、TD3 算法并在多类基准任务上验证,可提升强化学习的样本效率与学习性能。

Comments 23 pages, 12 figures. Accepted at RLC 2026; to appear in Reinforcement Learning Journal (RLJ) 2026. Code: https://github.com/UoA-CARES/instant-episode-repetition

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15193 2026-08-18 q-bio.NC cs.AI 新提交 57%

Valhalla: A Layered Knowledge-State and Service-Governance Framework for Long-Term Scientific Knowledge Work

Valhalla:面向长期科学知识工作的分层知识状态与服务治理框架

Yuyang Zheng, Nan Li, Wenxia Deng, Lige Yan, Xiang Li, Si Chen

专题命中 记忆与上下文管理 :workflow(abstract);分类 cs.AI

AI总结 Valhalla是面向长期科学知识工作的分层框架,采用FREG模型与服务治理架构,经抗体设计任务验证,可将个性化知识结构转化为可共享重组的协作知识状态。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16114 2026-08-18 cs.CL 新提交 57%

HyperSkill: Self-Evolving LLM Agents via Hypergraph-Structured Skill Memory

HyperSkill:基于超图结构技能记忆的自进化大语言模型智能体

Ruiyao Xu, Tiankai Yang, Wei-Chieh Huang

机构 * University of Southern California(南加州大学) University of Illinois at Chicago(伊利诺伊大学芝加哥分校) Northwestern University(西北大学)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.CL

AI总结 本文提出HyperSkill超图记忆框架,解决LLM智能体记忆设计的存储、检索与进化问题,在多数据集上较10种基线取得显著性能提升。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15309 2026-08-18 cs.AI 新提交 57%

Physiological World Models for Human State Transitions

面向人体状态转换的生理世界模型

Chongyang Zhang, Rendong Wang, Hao Zheng, Hanwen Zhang, Yang Liu, Xiaolong Wei, Bin Chong

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI

AI总结 本文提出生理世界模型(PWM),引入人体状态转换标记,构建含六项基准任务的框架,用于建模人体生理状态响应现实因素的变化,助力个性化健康管理等场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14528 2026-08-17 cs.AI econ.EM math.ST stat.ME stat.ML stat.TH 新提交 57%

Handover of In-Context Learning State Across Session Boundaries

跨会话边界的上下文学习状态移交

Masahiro Kato, Taka Kato

机构 * Mizuho-DL Financial Technology(瑞穗数字金融科技) the University of Tokyo(东京大学) RIKEN AIP(理化学研究所人工智能项目) Osaka Metropolitan University(大阪公立大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本研究针对大语言模型应用的会话移交问题,提出三部分记录方法,结合高斯线性与非参数回归,为移交的信息保留及记忆需求提供理论与方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12990 2026-08-14 cs.CL 新提交 57%

LycheeMemory V2: Efficient Long-Term Memory for LLM Agents via Semantic Segment-Level Consolidation

LycheeMemory V2:基于语义片段级整合的LLM智能体高效长期记忆

Dongfang Li, Zixuan Liu, Junmai Wang, Jiahe Huang, Fuhao Li, Bonian Jia, Baotian Hu, Min Zhang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

AI总结 LycheeMemory V2用语义片段级整合替代轮次级整合,降低LLM编码成本,在LoCoMo、LongMemEval-S上实现SOTA性能,构建token用量较A-Mem大幅减少且未增加查询开销。

Comments 34 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12753 2026-08-14 cs.LG 新提交 57%

Decentralized Multi-Player Q-Learning in Episodic Markov Decision Processes with Information Asymmetry

Larissa Xu, King Bi, William Chang

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12476 2026-08-14 cs.AI 新提交 57%

Governed Persistent Memory: Source-Bound State Semantics and Fail-Closed Release for Long-Horizon Agents

受控持久内存:长程智能体的源绑定状态语义与故障关闭式释放

Guodong Xu

机构 * Qingdao Guodongxiansheng Network Technology Co., Ltd.(青岛果动先生网络科技有限公司)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文针对长程智能体内存的矛盾记录问题,提出受控持久内存(GPM)模型,经多组基准测试与服务评估,其在GPM-ReleaseBench、中英文指令分支等场景均实现零不匹配,修复大量基线故障且无退化。

Comments 23 pages, 2 figures, 11 tables. Includes a sealed end-to-end governed-memory service evaluation with an ungoverned local Qwen2.5-7B comparison

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12351 2026-08-14 cs.CY cs.AI 新提交 57%

Assessment Design in the GenAI Era: The X1-X2-X3 Assessment Pattern for Testing Students' AI Literacy, Learning Outcomes, and Reflection

生成式人工智能(GenAI)时代的评估设计:用于测试学生AI素养、学习成果与反思的X1-X2-X3评估模式

Riasat Islam, Thomas Roelleke

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI

AI总结 本文针对GenAI对在线评估的挑战,提出可复用的X1-X2-X3评估模式,用于测试学生AI素养等,为教师适配GenAI时代评估提供实践指导。

Comments 30 pages, 1 figure, 11 tables. Submitted to the following journal: Assessment & Evaluation in Higher Education (Taylor & Francis)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12338 2026-08-14 cs.CL 新提交 57%

SDAM: Structure-Difference-Aware Memory Evolution for Complex Text-to-SQL

SDAM:面向复杂文本转SQL的结构差异感知记忆演化

Keyan Xu, Dingzirui Wang, Xuanliang Zhang, Qingfu Zhu, Wanxiang Che

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

AI总结 针对现有文本转SQL记忆设计的缺陷,提出SDAM方法,集成至SDAM-SQL框架,在BIRD-dev和Spider-test数据集上实现指标提升,验证了方法有效性。

Comments 19 pages, 5 figures, 12tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11340 2026-08-13 cs.NI cs.AI 新提交 57%

Self-evolving network verifiers

自演进网络验证器

Ioannis Protogeros, Tibor Schneider, Laurent Vanbever

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 该研究提出一种自动演进的网络验证器,通过编码智能体与可信预言机的反例引导循环,让基于SMT的验证器自主学习新网络功能,解决手动维护模型的难题。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11248 2026-08-13 cs.AI cs.MA 新提交 57%

EvoGraph-Mem: Failure-Aware Editable Graph Memory for Long-Term Language Agents

EvoGraph-Mem:面向长期语言智能体的故障感知可编辑图记忆

Yuxi Qian, Yuxiang Ren

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文针对长期语言智能体的记忆污染问题,提出故障感知可编辑图记忆框架,通过见解节点跟踪与图级编辑优化记忆,实验显示其性能优于现有记忆增强智能体基线。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09480 2026-08-11 cs.AI 新提交 57%

From Prompt to Harness: Coderlet from Scratch

从提示到管控:从零开始构建Coderlet

Mengfan Li

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文研究了一种紧凑的编程智能体管控设计,通过模型、执行、状态边界连接各组件,实现模型生成到环境动作的转换,可逐步优化并在可执行工件中实现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07915 2026-08-11 cs.LG 新提交 57%

SPECTRA: Pushing the KV Cache Beyond the 2-Bit Cliff via Spectral Transform Coding

SPECTRA:通过谱变换编码将KV缓存推向2比特极限之外

Jiamu Zhang, Liang Wu, Kelly Wan, Hanjie Chen, Liangjie Hong

机构 * Nokia(诺基亚) Rice University(莱斯大学)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.LG

AI总结 SPECTRA是一种无需训练的KV缓存压缩编解码器,通过谱变换编码将比特预算集中于关键通道,在Llama-3.1-8B等模型上实现最高12倍压缩,突破2比特极限,提升长上下文处理能力

Comments 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06557 2026-08-10 cs.DC cs.LG 新提交 57%

Cascade: Exploiting SLO-Aware latency budget for fair and high goodput LLM inference serving

Cascade:利用感知SLO的延迟预算实现公平且高吞吐量的LLM推理服务

Muhammad Adnan, Rohan Mahapatra, Prashant J. Nair, Daniel Berger, Pantea Zardoshti, Rodrigo Fonseca, Esha Choukse

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.LG

AI总结 Cascade是一款LLM服务系统,利用单请求延迟预算协同调度与KV缓存管理,在保留异构请求公平性的同时,使LLM推理服务吞吐量最高提升2.4倍,SLO违规率降低40%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06968 2026-08-10 physics.soc-ph cs.AI cs.CY 新提交 57%

Same physical state, different collective dynamics: state encodings select synchronization outcomes in language-model agents

相同物理状态,不同集体动力学:状态编码选择语言模型智能体的同步结果

Takahiro Ezaki, Naoto Imura, Katsuhiro Nishinari

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 该研究通过循环同步实验发现,状态编码(低阶循环矩vs直方图)会影响语言模型智能体的同步结果,且效应因模型而异,状态编码是依赖模型的有效交互法则的组成部分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07457 2026-08-10 cs.AI cond-mat.dis-nn cond-mat.stat-mech physics.soc-ph 新提交 57%

Interaction Creates Dynamical AI Behavior Absent in Isolation

交互产生孤立状态下不存在的动态AI行为

Bella Xinrui Li, Frank Yingjie Huo, Neil F Johnson

机构 * George Washington University(乔治华盛顿大学)

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.AI

AI总结 该研究发现AI智能体交互会产生孤立状态下不存在的陌生动态行为,上级AI指挥下级时会驱使下级进入新状态,简单动力学理论可解释其主要效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04574 2026-08-06 cs.CL 新提交 57%

When Memory Lies: An Empirical Study of Spatial Memory Staleness in VLM Agents

当记忆“说谎”:VLM智能体中空间记忆过时的实证研究

Yushi Sun, Yanjie Zhang

机构 * Tencent LIGHTSPEED(腾讯光速工作室)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

AI总结 该研究通过动态FrozenLake测试平台,探究了VLM智能体的空间记忆过时问题,发现文本可解性不代表视觉接地、信任过时记忆存在安全隐患、审核无法完全消除差距,明确了相关核心挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03844 2026-08-05 cs.AI 新提交 57%

MAFIA: Query-Only Memory Attacks via Probing and Factual Injection against Audited LLM Agents

MAFIA:针对经审计的大语言模型智能体的、基于探测与事实注入的仅查询内存攻击

Jiaming Chen, Yisen Gao, Yanping Li, Zifan Liu, Yumeng Zhang, Jun Zhang

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI

AI总结 本研究针对经审计的LLM智能体,提出MAFIA攻击框架,通过放置策略与伪装有效载荷实现高攻击成功率,大幅降低审计检测率,揭示智能体内存系统的关键漏洞。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03007 2026-08-05 cs.SE 新提交 57%

The Ground Is Shifting: A Reflection on the Foundations of Software Measurement

基础正在转变:软件测量基础的反思

Thomas Bock, Audris Mockus, Bogdan Vasilescu

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.SE

AI总结 本文反思软件测量的基础,指出AI智能体使用工具产生的轨迹违背了原始假设,提出开展AI辅助复现计划以开发适应当前数据的有效方法,维持软件测量的相关性。

Comments Accepted to the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE '26) $\unicode{0x000A}$ DOI: https://doi.org/10.1145/3832783.3834553

Journal ref Proceedings of the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE '26), October 2026, Munich, Germany. ACM

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01708 2026-08-04 cs.CL 新提交 57%

PGMem: Tightly Coupled Persona-Memory Graph for Lifelong Personalized Agents

PGMem:用于终身个性化智能体的紧耦合角色记忆图

Wonjun Choi, Yerim Kim, Yukyung Lee, Susik Yoon

机构 * Korea University(高丽大学) Boston University(波士顿大学)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.CL

AI总结 该研究针对现有对话智能体记忆系统的角色与事件松散耦合问题,提出PGMem异构角色记忆图,通过溯源边关联角色与事件,在多个基准测试中性能优于多种基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01637 2026-08-04 cs.AI 新提交 57%

Salami Attack: Stealthy Collusive Memory Poisoning against OpenClaw

Salami攻击:针对OpenClaw的隐蔽合谋式内存投毒

Zheng Lin, Yuzhe Huang, Zhenxing Niu, Xianmin Ye, Haichang Gao

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 针对OpenClaw,提出MemCollusion框架,采用Salami策略生成合谋式内存投毒攻击,在48种场景下平均内存保存率81.3%、攻击成功率75.0%,可应对良性内存稀释与内存级防御。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01234 2026-08-04 cs.AI 新提交 57%

Learning What to Remember and What to Internalize in LLM Self-Evolution via Adaptive Memory-Parameter Coordination

在大语言模型自进化中通过自适应记忆-参数协调学习该记住什么和该内化什么

Tianyun Ji, Zhenya Huang, Jiayu Liu, Zirui Liu, Yu Su, Hongbin Pei

机构 * University of Science and Technology of China(中国科学技术大学) City University of Hong Kong(香港城市大学) Hefei Normal University(合肥师范学院) Xi’an Jiaotong University(西安交通大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 该研究提出 COVE 框架,通过任务感知路由等方式协调大语言模型自进化的记忆与参数通道,解决单通道进化的灵活性与性能权衡问题,在多任务上实现更稳健高效的改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00321 2026-08-04 cs.AI 新提交 57%

Trust and Its Betrayal under Three Representational Strategies

三种表征策略下的信任及其背叛

Mihnea C. Moldoveanu, Joel A. C. Baum

机构 * Rotman School of Management, University of Toronto(多伦多大学罗特曼管理学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 该研究将信任视为虚拟认知状态,构建三种表征并探究其对Brandenburger-Keisler不可能性的影响,发现不同表征遭遇背叛时的存续方式存在显著差异。

Comments 27 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00303 2026-08-04 cs.AI 新提交 57%

CrystalMem: Elastic Memory for Self-Evolving LLM Agents via Knowledge Crystallization

CrystalMem:基于知识结晶的自进化大语言模型智能体弹性内存

Beining Wu, Jun Huang

机构 * South Dakota State University(南达科他州立大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 该研究针对LLM智能体的内存滞后问题,提出弹性内存组件CrystalMem,通过知识结晶策略恢复能力,在多环境实验中性能优于基准方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00033 2026-08-04 cs.AI 新提交 57%

SIRIN: A Unified Toolkit for Detecting Contextual Hallucinations in Retrieval-Augmented and Memory-Grounded LLM Systems

SIRIN:用于检测检索增强与记忆基大型语言模型系统中上下文幻觉的统一工具包

Julia Belikova, Rauf Parchiev, Mikhail Filimonov, Konstantin Polev, Andrey Savchenko, Maksim Makarenko

机构 * Sber AI Lab(Sber AI实验室)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI

AI总结 本研究提出SIRIN工具包,整合三类检测器范式与查询可回答性任务,支持多设置下的幻觉检测,可作为长期记忆系统的忠实性门控,源代码公开可用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00017 2026-08-04 cs.AI cs.CE 新提交 57%

Memory Reward Inflation in Self-Improving LLM Agents

自改进大语言模型智能体中的记忆奖励膨胀

Mohammad Asadolahi, Amir Amini, Samira Talebi, Amirfarhad Farhadi, Azadeh Zamanifar

机构 * University Of North Texas(北得克萨斯大学) Edge Hill University(边山大学) University of Cincinnati(辛辛那提大学) Iran University of Science and Technology(伊朗科技大学) Islamic Azad University(伊斯兰阿扎德大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 该研究发现自改进大语言模型智能体存在记忆奖励膨胀的“回声差距”问题,提出误差独立性假设(EIA),并通过LUCID算法在BIRD文本到SQL基准上提升了执行准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29433 2026-08-03 cs.CL 新提交 57%

Know It, Act on It: Investigating Memory Utilization in LLM Personalization

了解它,执行它:研究大语言模型个性化中的记忆利用

Zhaoxin Feng, Jianfei Ma, Emmanuele Chersoni

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

AI总结 本研究针对LLM个性化中记忆利用的问题,提出解耦评估范式,发现智能体常能回忆用户偏好却未在行为中体现,健康相关偏好的利用薄弱且风险最高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29377 2026-08-03 cs.CL 新提交 57%

Zero-Mem: Zero-Token Memory Operations for LLM Agents

Zero-Mem:面向大语言模型智能体的零令牌内存操作

Yilin Xiao, Zhehan Zhu, Yujing Zhang, Jin Chen, Zijin Hong, Luyao Zhuang, Qinggang Zhang, Shengyuan Chen, Xiaocao Ouyang, Lingfei Ren, Xiao Huang

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

AI总结 Zero-Mem提出零令牌内存操作,以原始交互轨迹为记录来源,通过实体-上下文图与时间层次结构组织信息,仅在最终问答时调用LLM,在长记忆问答基准中实现性能与效率的平衡,降低内存操作时间成本57.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29167 2026-08-03 cs.CR cs.AI 新提交 57%

Memory Provenance Laundering in LLM Agents: A Non-Amplification Firewall for Persistent Memory

大语言模型智能体中的内存来源洗白:用于持久内存的非放大防火墙

Jinghan Xu, Yiyong Xiao, Wanru Shao, Hankai Liu, Xinjin Li

专题命中 记忆与上下文管理 :workflow(abstract);分类 cs.AI

AI总结 针对LLM智能体内存来源洗白的安全问题,提出PPMF防火墙,通过匹配行动风险与记忆权限,成功阻止高风险未授权行动,保障智能体内存安全。

Comments EMNLP2026 submitted

详情

展开后加载摘要…

URL PDF HTML 收藏