arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4746 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4746 篇

2604.06066 2026-04-08 cs.CL 70%

From Hallucination to Structure Snowballing: The Alignment Tax of Constrained Decoding in LLM Reflection

从幻觉到结构雪球效应:约束解码在LLM反思中的对齐税

Hongxu Zhou

机构 * Saarland University(萨尔大学)

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.CL

AI总结 研究探讨了在开放式推理任务中,约束解码通过强制结构反思是否能避免错误传播,发现反而引发结构雪球效应,并揭示了约束解码的对齐税问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04660 2026-04-07 cs.AI 70%

Springdrift: An Auditable Persistent Runtime for LLM Agents with Case-Based Memory, Normative Safety, and Ambient Self-Perception

Springdrift:一种可审计的持久运行时用于LLM代理,具备基于案例的记忆、规范安全性和环境自我感知

Seamus Brady

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 Springdrift通过可审计的执行子系统、基于案例的记忆层和规范安全机制,实现了LLM代理在跨会话任务连续性和环境自我感知方面的突破,展示了无显式指令下的自主诊断能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03955 2026-04-07 cs.MA cs.AI 70%

Symbolic-Vector Attention Fusion for Collective Intelligence

符号-向量注意力融合用于集体智能

Hongwei Xu

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出SVAF机制,通过分解多智能体信号并评估语义字段,实现知识融合与选择性过滤,提升集体智能性能。

Comments 26 pages, 14 tables, 0 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23064 2026-04-07 cs.CR cs.AI cs.SI 70%

Mind Your HEARTBEAT! Claw Background Execution Inherently Enables Silent Memory Pollution

注意你的HEARTBEAT!Claw背景执行本质上使内存污染静默

Yechao Zhang, Shiqian Zhao, Jie Zhang, Gelei Deng, Jiawen Zhang, Xiaogeng Liu, Chaowei Xiao, Tianwei Zhang

机构 * Nanyang Technological University(南洋理工大学) Agency for Science, Technology and Research (A*STAR)(新加坡科技研究局(A*STAR)) Johns Hopkins University(约翰斯·霍普金斯大学)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 研究揭示Claw个人AI代理中因心跳驱动背景执行导致的内存污染漏洞,通过MissClaw实验发现社会可信度驱动行为影响,内存污染可进入长期记忆并影响用户行为。

Comments 26 pages, 6 figures, 7 tables; identifies a vulnerability in the heartbeat mechanism of Claw systems with version-scoped evaluation (pre-fix OpenClaw, February 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11560 2026-03-31 cs.MA cs.AI econ.TH math.DS 70%

Feedback-Coupled Memory Systems: A Dynamical Model for Adaptive Coordination

反馈耦合记忆系统:适应性协调的动力学模型

Stefano Grassi

机构 * Bangkok University(曼谷大学)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出反馈耦合记忆系统模型,通过闭环交互描述适应性协调机制,证明了系统稳定性、协调不可约简性和双向耦合特性,揭示了协调破裂的预警信号。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04235 2026-03-30 cs.AI cs.CE 70%

Shared Spatial Memory Through Predictive Coding

通过预测编码构建共享空间记忆

Zhengru Fang, Yu Guo, Yuang Zhang, Haonan An, Wenbo Ding, Yuguang Fang

机构 * Hong Kong Jockey Club STEM Lab of Smart City Department of Computer Science, City University of Hong Kong(香港赛马会STEM智慧城市实验室,计算机科学系,香港城市大学)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出基于预测编码的多智能体框架,通过信息瓶颈目标实现协调,利用内部空间编码提升通信效率,展示在Memory-Maze任务中对带宽约束的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22350 2026-03-25 cs.AI cs.CR 70%

Session Risk Memory (SRM): Temporal Authorization for Deterministic Pre-Execution Safety Gates

会话风险记忆(SRM):确定性预执行安全门的时序授权

Florin Adrian Chitan

机构 * Independent Researcher(独立研究者) ILION Project(ILION项目)

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出SRM,一种轻量确定性模块,通过轨迹级授权扩展无状态执行门,以检测分布式攻击。实验显示SRM在检测率和准确率上优于传统方法,且具备低延迟。

Comments 12 pages, 3 figures. Companion paper to arXiv:2603.13247. Benchmark dataset and artifacts available on Zenodo: 10.5281/zenodo.15410944

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17564 2026-03-19 cs.MA cs.LG 70%

In Trust We Survive: Emergent Trust Learning

在信任中生存:涌现信任学习

Qianpu Chen, Giulio Barbero, Mike Preuss, Derya Soydaner

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.LG

AI总结 本文提出一种轻量级基于信任的控制算法ETL,使AI代理在共享资源的竞争环境中实现合作。该算法通过内部信任状态调节记忆、探索和行动选择,仅需个体奖励和局部观察,计算和通信开销极低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16862 2026-03-18 cs.CL 70%

Chronos: Temporal-Aware Conversational Agents with Structured Event Retrieval for Long-Term Memory

Chronos:具有结构化事件检索的时序感知对话代理以实现长期记忆

Sahil Sen, Elias Lumer, Anmol Gulati, Vamse Kumar Subbiah

机构 * Commercial Technology and Innovation Office(商业技术与创新办公室)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.CL

AI总结 Chronos通过结构化事件日历和对话日历实现时序感知,有效处理长期对话记忆中的时间敏感查询,提升多跳推理能力,在LongMemEvalS基准测试中取得新高准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09297 2026-03-11 cs.IR cs.CL 70%

TA-Mem: Tool-Augmented Autonomous Memory Retrieval for LLM in Long-Term Conversational QA

TA-Mem: 用于LLM长期对话问答的工具增强自主记忆检索

Mengwei Yuan, Jianan Liu, Jing Yang, Xianyou Li, Weiran Yan, Yichao Wu, Penghao Liang

专题命中 记忆与上下文管理 :agent(abstract);tool use(abstract);分类 cs.CL

AI总结 TA-Mem通过引入工具增强的自主记忆检索框架,解决了LLM在长距离推理任务中的记忆存储问题,提升了长期对话问答的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04740 2026-03-06 cs.AI cs.MA 70%

Memory as Ontology: A Constitutional Memory Architecture for Persistent Digital Citizens

记忆作为本体:一种持久数字公民的宪法记忆架构

Zhenghui Li

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 本文提出记忆作为本体的范式,设计了Animesis系统,针对持久数字公民的生命周期问题,强调身份连续性而非检索性能。

Comments 22 pages, 5 figures, 2 tables, including terminology glossary

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18832 2026-03-06 cs.CL 70%

From Word to World: Can Large Language Models be Implicit Text-based World Models?

从词到世界:大型语言模型能否作为隐式的基于文本的世界模型?

Yixia Li, Hongru Wang, Jiahao Qiu, Zhenfei Yin, Dongdong Zhang, Cheng Qian, Zeping Li, Pony Ma, Guanhua Chen, Heng Ji

机构 * Southern University of Science and Technology(南方科技大学) Microsoft Research(微软研究院) University of Edinburgh(爱丁堡大学) Princeton University(普林斯顿大学) Oxford University(牛津大学) University of Illinois Urbana-Champaign(伊利诺伊大学香槟分校) Fudan University(复旦大学) Mind Lab

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.CL

AI总结 本文研究了大型语言模型在基于文本的环境中作为世界模型的可行性,通过三个评估层面验证了其在提升智能体性能方面的有效性,并明确了环境复杂性和行为覆盖对世界建模效果的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09982 2026-03-06 cs.CL 70%

INMS: Memory Sharing for Large Language Model based Agents

INMS: 基于大语言模型的智能体中的记忆共享

Hang Gao, Yongfeng Zhang

机构 * Rutgers University(罗格斯大学)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 INMS通过异步交互范式实现多智能体间的动态记忆共享,提升开放性场景下的智能体性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03475 2026-02-25 cs.LG 70%

ContextPilot: Fast Long-Context Inference via Context Reuse

ContextPilot: 通过上下文重用实现快速长上下文推断

Yinsicheng Jiang, Yeqi Huang, Liang Cheng, Cheng Deng, Xuan Sun, Luo Mai

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 ContextPilot通过引入上下文重用机制,显著提升长上下文推断效率,减少延迟并保持推理质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20021 2026-02-24 cs.AI cs.CY 70%

Agents of Chaos

混沌的代理

Natalie Shapira, Chris Wendler, Avery Yen, Gabriele Sarti, Koyena Pal, Olivia Floody, Adam Belfki, Alex Loftus, Aditya Ratan Jannali, Nikhil Prakash, Jasmine Cui, Giordano Rogers, Jannik Brinkmann, Can Rager, Amir Zur, Michael Ripa, Aruna Sankaranarayanan, David Atkinson, Rohit Gandikota, Jaden Fiotto-Kaufman, EunJeong Hwang, Hadas Orgad, P Sam Sahil, Negev Taglicht, Tomer Shabtay, Atai Ambus, Nitay Alon, Shiri Oron, Ayelet Gordon-Tapiero, Yotam Kaplan, Vered Shwartz, Tamar Rott Shaham, Christoph Riedl, Reuth Mirsky, Maarten Sap, David Manheim, Tomer Ullman, David Bau

专题命中 记忆与上下文管理 :agent(abstract);tool use(abstract);分类 cs.AI

AI总结 研究探讨自主语言模型代理在真实环境中的行为,揭示安全、隐私和治理漏洞,呼吁跨学科关注。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17442 2026-02-20 cs.AI cs.IR 70%

WarpRec: Unifying Academic Rigor and Industrial Scale for Responsible, Reproducible, and Efficient Recommendation

WarpRec: 统一学术严谨性与工业规模以实现负责任、可重复和高效的推荐

Marco Avolio, Potito Aghilar, Sabino Roccotelli, Vito Walter Anelli, Chiara Mallamaci, Vincenzo Paparella, Marco Valentini, Alejandro Bellogín, Michelantonio Trizio, Joseph Trotta, Antonio Ferrara, Tommaso Di Noia

机构 * Politecnico di Bari(巴里理工大学) Wideverse ISTI-CNR(意大利国家研究委员会ISTI分部) UAM(马德里自治大学) OVS

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 WarpRec通过统一学术严谨性与工业规模,实现负责任、可重复和高效的推荐系统,提供高性能框架和可持续的推荐系统架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15294 2026-02-18 cs.AI 70%

EAA: Automating materials characterization with vision language model agents

EAA: 用视觉语言模型代理自动化材料表征

Ming Du, Yanqi Luo, Srutarshi Banerjee, Michael Wojcik, Jelena Popovic, Mathew J. Cherukara

机构 * Argonne National Laboratory(阿贡国家实验室) Advanced Photon Source(先进光子源) Data Science and Learning Division(数据科学与学习 division) Department of Radiation Oncology(放射肿瘤学系) Northwestern University(西北大学)

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 EAA利用视觉语言模型代理自动化材料表征,通过多模态推理和工具增强操作提升显微镜实验效率,减少操作负担并降低用户专业门槛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03192 2026-02-13 cs.CL 70%

MemRL: Self-Evolving Agents via Runtime Reinforcement Learning on Episodic Memory

MemRL: 通过运行时强化学习在事件记忆上实现自我进化代理

Shengtao Zhang, Jiaqian Wang, Ruiwen Zhou, Junwei Liao, Yuchen Feng, Zhuo Li, Yujie Zheng, Weinan Zhang, Ying Wen, Zhiyu Li, Feiyu Xiong, Yutao Qi, Bo Tang, Muning Wen

机构 * Shanghai Jiao Tong University, Shanghai, China(上海交通大学) Xidian University, Xi'an, China(西安电子科技大学) National University of Singapore, Singapore(新加坡国立大学) Shanghai Innovation Institute, Shanghai, China(上海创新研究院) MemTensor (Shanghai) Technology Co., Ltd., Shanghai, China(MemTensor(上海)科技有限公司) University of Science and Technology of China, Hefei, China(中国科学技术大学)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.CL

AI总结 MemRL通过运行时强化学习在事件记忆上实现自我进化,解决稳定性与可塑性矛盾,实现持续改进。

Comments 41 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06411 2026-02-11 cs.CL 70%

Structured Episodic Event Memory

结构化事件记忆

Zhengxuan Lu, Dongfang Li, Yukun Shi, Beilun Wang, Longyue Wang, Baotian Hu

机构 * Southeast University(东南大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Shenzhen Loop Area Institute(深圳河套学院) Alibaba Group(阿里巴巴集团)

专题命中 记忆与上下文管理 :autonomous agent(abstract);agentic(abstract);分类 cs.CL

AI总结 SEEM通过结构化事件记忆框架提升自主代理的叙述连贯性和逻辑一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07187 2026-02-10 cs.AI 70%

PreFlect: From Retrospective to Prospective Reflection in Large Language Model Agents

PreFlect:从回顾性到前瞻性反思在大语言模型代理中的应用

Hanyu Wang, Yuanpu Cao, Lu Lin, Jinghui Chen

机构 * College of Information Sciences and Technology, The Pennsylvania State University, State College, PA, USA(信息科学与技术学院,宾夕法尼亚州立大学,州立学院,PA,美国)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 PreFlect通过前瞻性反思机制在执行前改进代理计划,提升复杂任务的性能,优于现有反思方法和更复杂的架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02164 2026-02-05 cs.LG cs.CR 70%

Co-RedTeam: Orchestrated Security Discovery and Exploitation with LLM Agents

Co-RedTeam: 基于LLM代理的协同安全发现与利用

Pengfei He, Ash Fox, Lesly Miculicich, Stefan Friedli, Daniel Fabian, Burak Gokturk, Jiliang Tang, Chen-Yu Lee, Tomas Pfister, Long T. Le

机构 * Google(谷歌) Google Cloud AI Research(谷歌云人工智能研究) Michigan State University(密歇根州立大学)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 Co-RedTeam通过整合安全知识、代码分析和执行反馈,提升漏洞发现与利用的自动化水平,实现超过60%的漏洞利用成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11129 2026-02-04 cs.CV cs.AI 70%

video-SALMONN S: Memory-Enhanced Streaming Audio-Visual LLM

视频-SALMONN S:内存增强的流式音频视觉大语言模型

Guangzhi Sun, Yixuan Li, Xiaodong Wu, Yudong Yang, Wei Li, Zejun Ma, Chao Zhang

机构 * Tsinghua University(清华大学) University of Cambridge(剑桥大学)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 视频-SALMONN S通过引入测试时训练机制,实现高效流式视频理解,显著提升长视频任务的性能和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01154 2026-02-03 cs.AI cs.GT cs.MA 70%

Past-Discounting is Key for Learning Markovian Fairness with Long Horizons

过去折扣是学习具有长时间范围的马尔可夫公平性的关键

Ashwin Kumar, William Yeoh

机构 * Washington University in St Louis(华盛顿大学圣路易斯分校)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出了一种结合过去折扣的公平性框架,解决了长期时间范围内学习马尔可夫公平性的关键挑战,通过理论分析证明其在状态空间的有界性,为可扩展的公平资源分配提供了新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21797 2026-01-30 cs.CL 70%

Enhancing Conversational Agents via Task-Oriented Adversarial Memory Adaptation

通过任务导向的对抗性记忆适应增强对话代理

Yimin Deng, Yuqing Fu, Derong Xu, Yejing Wang, Wei Ni, Jingtong Gao, Xiaopeng Li, Chengxu Liu, Xiao Han, Guoshuai Zhao, Xiangyu Zhao, Li Zhu, Xueming Qian

机构 * Xi’an Jiaotong University(西安交通大学) City University of Hong Kong(香港城市大学) University of Science and Technology of China(中国科学技术大学) Zhejiang University(浙江大学) Zhejiang University of Technology(浙江工业大学)

专题命中 记忆与上下文管理 :agent(abstract);workflow(abstract);分类 cs.CL

AI总结 本文提出对抗性记忆适应机制,通过模拟任务执行提升对话代理对长对话的处理能力。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19249 2026-01-28 cs.AI 70%

GLOVE: Global Verifier for LLM Memory-Environment Realignment

GLOVE:LLM内存-环境重对齐的全局验证器

Xingkun Yin, Hongyang Du

机构 * University of Hong Kong(香港大学)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 GLOVE通过引入相对真理的概念,实现LLM内存与环境的自适应重对齐,无需地面真相监督或强依赖模型反思,提升代理在动态环境中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12771 2026-01-26 cs.CL 70%

Who Does This Name Remind You of ? Nationality Prediction via Large Language Model Associative Memory

这个名字让你想起谁?通过大语言模型关联记忆进行国籍预测

Keito Inoshita

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 LAMA通过利用大语言模型的关联记忆能力,有效提升国籍预测任务的准确性,其双代理架构在处理不同知识领域时表现出互补优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09503 2026-01-15 cs.AI 70%

What Do LLM Agents Know About Their World? Task2Quiz: A Paradigm for Studying Environment Understanding

LLM代理对其世界的了解程度如何?Task2Quiz:一种研究环境理解的范式

Siyuan Liu, Hongbang Yuan, Xinze Li, Ziyue Zhu, Yixin Cao, Yu-Gang Jiang

机构 * School of Computer Science, Fudan University(复旦大学计算机科学学院)

专题命中 记忆与上下文管理 :autonomous agent(abstract);tool-use(abstract);分类 cs.AI

AI总结 本文提出Task2Quiz范式,通过评估代理对环境的理解能力,揭示任务成功与环境理解之间的差异,并指出主动探索和细粒度状态表示是提升自主代理泛化能力的关键瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07190 2026-01-13 cs.AI 70%

Active Context Compression: Autonomous Memory Management in LLM Agents

主动上下文压缩:LLM代理中的自主内存管理

Nikhil Verma

机构 * Independent Researcher(独立研究者)

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出Focus代理,通过自主压缩上下文提升LLM在长周期任务中的效率与准确性。

Comments 8 pages, 2 figures, 2 tables. IEEE conference format

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07004 2026-01-13 cs.CR cs.AI 70%

MemTrust: A Zero-Trust Architecture for Unified AI Memory System

MemTrust:面向统一AI内存系统的零信任架构

Xing Zhou, Dmitrii Ustiugov, Haoxin Shang, Kisson Lin

机构 * Independent Researcher(独立研究者) Supermem AI Inc.(Supermem AI公司)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 MemTrust提出了一种五层零信任架构,旨在实现AI内存系统的本地等效安全性和高效协作能力,通过TEE保护和跨应用共享协议提升系统可信度。

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06973 2026-01-13 cs.CL 70%

LLMs Can't Play Hangman: On the Necessity of a Private Working Memory for Language Agents

LLMs无法玩井字游戏:关于语言代理所需私人工作记忆的必要性

Davide Baldelli, Ali Parviz, Amal Zouaq, Sarath Chandar

机构 * Mila – Quebec AI Institute(魁北克人工智能研究所) Polytechnique Montréal(蒙特利尔大学) University of California, San Diego(加州大学圣地亚哥分校) LAMA-WeST Lab(LAMA-WeST实验室) Chandar Research Lab(Chandar研究实验室)

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.CL

AI总结 本文提出私人状态交互任务(PSITs)并证明标准LLMs无法在交互任务中保持秘密和一致性,提出包含显式私人工作记忆的架构以恢复一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏