arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 4746 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 4746 篇

2001.06781 2020-01-22 cs.AI 76%

FRESH: Interactive Reward Shaping in High-Dimensional State Spaces using Human Feedback

Baicen Xiao, Qifan Lu, Bhaskar Ramasubramanian, Andrew Clark, Linda Bushnell, Radha Poovendran

专题命中 记忆与上下文管理 :agent(abstract,comments);autonomous agent(abstract,comments);分类 cs.AI;multi-agent(comments)

Comments Accepted as Full Paper to International Conference on Autonomous Agents and Multi-Agent Systems (AAMAS) 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15671 2026-08-04 cs.RO 版本更新 75%

Long-Term Memory for VLA-based Agents in Open-World Task Execution

基于VLA的智能体长期记忆在开放世界任务执行中的应用

Xu Huang, Weixin Mao, Yinhao Li, Hua Chen, Jiabao Zhao

机构 * Nanjing University(南京大学) LimX Dynamics(LimX 动态)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);planning(abstract)

AI总结 本文提出ChemBot框架,通过双层记忆和MCP服务器提升复杂化学实验中的任务执行效率与安全性。

Comments Added references

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21125 2026-07-24 cs.CV 新提交 75%

Causal-AgentIR: Self-Evolving Causal Memory for Adaptive Image Restoration Agents

因果智能体图像恢复:用于自适应图像恢复智能体的自进化因果记忆

Hu Gao, Yulong Chen, Lizhuang Ma

机构 * Shanghai Jiao Tong University(上海交通大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 针对图像恢复智能体知识存储局限,提出Causal-AgentIR框架,通过构建结构化因果记忆图及协作系统,支持智能体进行因果推理,依质量变化和反馈调整恢复经验,有效提升图像恢复能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05404 2026-06-05 cs.AI cs.CL cs.LG 75%

Harnessing Generalist Agents for Contextualized Time Series

利用通用智能体进行情境化时间序列分析

Zihao Li, Kaifeng Jin, Yuanchen Bei, Jiaru Zou, Avaneesh Kumar, Xuying Ning, Yanjun Zhao, Mengting Ai, Baoyu Jing, Hanghang Tong, Jingrui He

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 记忆与上下文管理 :AI agent(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出TimeClaw框架,通过集成可执行时间工具、经验驱动能力进化和情景多模态记忆,使通用大语言模型智能体具备情境化时间推理能力,在能源、金融等多领域基准上取得性能提升。

Comments Preprint. 38 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1507.01585 2026-06-04 math.OC cs.SY eess.SY 75%

Finite-Horizon Markov Decision Processes with State Constraints

有限时间 horizon 马尔可夫决策过程与状态约束

Mahmoud El Chamie, Behcet Acikmese

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种高效算法,用于解决有限时间 horizon 约束马尔可夫决策过程中的非稳态随机策略问题,通过线性规划和对偶理论保证最优性。

Comments submitted to IEEE CDC 2015. arXiv admin note: text overlap with arXiv:1507.01151

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11258 2026-05-12 cs.LG cs.AI cs.CL 75%

Knowledge is Not Enough: Injecting RL Skills for Continual Adaptation

知识不足:注入强化学习技能以实现持续适应

Pingzhi Tang, Yiding Wang, Muhan Zhang

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) Yuanpei College, Peking University(北京大学元培学院)

专题命中 记忆与上下文管理 :tool-use(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出PaST框架,通过提取领域无关的Skill Vector,实现高效知识适应。实验表明PaST在知识问答和工具使用任务中优于现有方法,展现出良好的可扩展性和跨领域迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10846 2026-03-12 cs.LG cs.AI cs.CL 75%

Towards Cold-Start Drafting and Continual Refining: A Value-Driven Memory Approach with Application to NPU Kernel Synthesis

迈向冷启动起草与持续细化:一种价值驱动的记忆方法及其在NPU内核合成中的应用

Yujie Zheng, Zhuo Li, Shengtao Zhang, Hanjing Wang, Junjie Sheng, Jiaqian Wang, Junchi Yan, Weinan Zhang, Ying Wen, Bo Tang, Muning Wen

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 EvoKernel通过价值驱动的记忆强化学习方法,提升NPU内核合成的正确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17676 2026-02-23 cs.AI cs.CL cs.LG 75%

Epistemic Traps: Rational Misalignment Driven by Model Misspecification

知识陷阱:由模型规格不准确驱动的理性偏差

Xingcheng Xu, Jingjing Qu, Qiaosheng Zhang, Chaochao Lu, Yanqing Yang, Na Zou, Xia Hu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ShanghaiTech University(上海科技大学)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出主观模型工程,通过设计代理的内部信念结构来实现稳健对齐,揭示安全由认知先验决定而非奖励大小连续函数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16173 2026-02-19 cs.AI cs.CL cs.LG 75%

Learning Personalized Agents from Human Feedback

从人类反馈中学习个性化代理

Kaiqu Liang, Julia Kruk, Shengyi Qian, Xianjun Yang, Shengjie Bi, Yuanshun Yao, Shaoliang Nie, Mingyang Zhang, Lijuan Liu, Jaime Fernández Fisac, Shuyan Zhou, Saghar Hosseini

机构 * Meta Superintelligence Labs(Meta超智能实验室) Princeton University(普林斯顿大学) Duke University(杜克大学)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 PAHF通过整合显式记忆与双反馈通道,实现持续个性化,显著提升学习速度和适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14951 2026-02-17 cs.CY cs.HC 75%

Sovereign Agents: Towards Infrastructural Sovereignty and Diffused Accountability in Decentralized AI

主权代理:迈向去中心化AI中的基础设施主权与扩散问责

Botao Amber Hu, Helena Rong

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);agentic(abstract)

AI总结 本文探讨去中心化AI中基础设施主权的概念,分析其与扩散问责的关系,并提出治理策略以应对非终止AI代理带来的挑战。

Comments Submitted to FAccT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05854 2026-02-06 cs.HC 75%

DuoDrama: Supporting Screenplay Refinement Through LLM-Assisted Human Reflection

DuoDrama: 通过LLM辅助的人类反思支持剧本润色

Yuying Tang, Xinyi Chen, Haotian Li, Xing Xie, Xiaojuan Ma, Huamin Qu

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);workflow(abstract)

AI总结 DuoDrama通过LLM辅助人类反思,提升剧本润色阶段的反馈质量和反思深度。

Comments Accepted by CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00083 2026-02-03 cs.IR cs.AI cs.CL cs.LG 75%

SPARC-RAG: Adaptive Sequential-Parallel Scaling with Context Management for Retrieval-Augmented Generation

SPARC-RAG:基于上下文管理的自适应顺序-并行扩展用于检索增强生成

Yuxin Yang, Gangda Deng, Ömer Faruk Akgül, Nima Chitsazan, Yash Govilkar, Akasha Tigalappanavara, Shi-Xiong Zhang, Sambit Sahu, Viktor Prasanna

机构 * University of Southern California(南加州大学) Capital One

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 SPARC-RAG通过多代理框架实现顺序与并行扩展的协调,提升检索增强生成在多跳问答中的性能和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03655 2026-01-08 cs.CV 75%

VideoMemory: Toward Consistent Video Generation via Memory Integration

VideoMemory: 通过记忆整合实现一致的视频生成

Jinsong Zhou, Yihua Du, Xinli Xu, Luozhou Wang, Zijie Zhuang, Yehang Zhang, Shuaibo Li, Xiaojun Hu, Bolan Su, Ying-cong Chen

机构 * HKUST(GZ)(香港科技大学(广州)) HKUST(香港科技大学) ByteDance(字节跳动)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 VideoMemory通过动态记忆库整合叙事规划与视觉生成,实现多镜头中角色、道具和环境的一致性生成。

Comments Project page: https://hit-perfect.github.io/VideoMemory/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10304 2026-01-06 cs.LG cs.AI cs.CL 75%

Sample-Efficient Online Learning in LM Agents via Hindsight Trajectory Rewriting

通过回顾轨迹重写实现LM代理的样本高效在线学习

Michael Y. Hu, Benjamin Van Durme, Jacob Andreas, Harsh Jhamtani

机构 * New York University(纽约大学) Microsoft(微软)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 ECHO通过回顾轨迹重写提升LM代理的样本效率,有效利用过去经验以更快适应新环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26536 2025-10-31 cs.RO 75%

RoboOS-NeXT: A Unified Memory-based Framework for Lifelong, Scalable, and Robust Multi-Robot Collaboration

Huajie Tan, Cheng Chi, Xiansheng Chen, Yuheng Ji, Zhongxia Zhao, Xiaoshuai Hao, Yaoxu Lyu, Mingyu Cao, Junkai Zhao, Huaihai Lyu, Enshen Zhou, Ning Chen, Yankai Fu, Cheng Peng, Wei Guo, Dong Liang, Zhuo Chen, Mengsi Lyu, Chenrui He, Yulong Ao, Yonghua Lin, Pengwei Wang, Zhongyuan Wang, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(1 多媒体信息处理国家重点实验室,计算机学院,北京大学) Beijing Academy of Artificial Intelligence(2 北京人工智能研究院) Institute of Automation, Chinese Academy of Sciences(3 中国科学院自动化研究所) Beihang University(4 北航大学)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);multi-agent(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07008 2025-10-16 cs.GT cs.MA 75%

Constant-Memory Strategies in Stochastic Games: Best Responses and Equilibria

Fengming Zhu, Fangzhen Lin

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);multi-agent(abstract)

Comments 21 pages. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15182 2025-09-30 cs.CL cs.AI cs.LG 75%

ReflAct: World-Grounded Decision Making in LLM Agents via Goal-State Reflection

Jeonghye Kim, Sojeong Rhee, Minbeom Kim, Dohyung Kim, Sangmook Lee, Youngchul Sung, Kyomin Jung

机构 * KAIST(韩国科学技术院) Seoul National University(首尔国立大学)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

Comments Accepted to EMNLP 2025 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23454 2025-08-04 cs.HC cs.CY cs.ET cs.GR q-bio.NC 75%

Breaking the mould of Social Mixed Reality - State-of-the-Art and Glossary

Marta Bieńkiewicz, Julia Ayache, Panayiotis Charalambous, Cristina Becchio, Marco Corragio, Bertram Taetz, Francesco De Lellis, Antonio Grotta, Anna Server, Daniel Rammer, Richard Kulpa, Franck Multon, Azucena Garcia-Palacios, Jessica Sutherland, Kathleen Bryson, Stéphane Donikian, Didier Stricker, Benoît Bardy

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);multi-agent(abstract)

Comments pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12927 2025-06-17 cs.AI cs.CL cs.LG 75%

Sectoral Coupling in Linguistic State Space

Sebastian Dumbrava

机构 * Sebastian Dumbrava(独立研究者)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

Comments 56 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18279 2025-05-27 cs.MA cs.AI cs.CL cs.LG 75%

Collaborative Memory: Multi-User Memory Sharing in LLM Agents with Dynamic Access Control

Alireza Rezazadeh, Zichao Li, Ange Lou, Yuying Zhao, Wei Wei, Yujia Bao

机构 * Center for Advanced AI, Accenture(Accenture高级人工智能研究中心)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02810 2025-04-09 cs.AI cs.CL cs.LG 75%

StateAct: Enhancing LLM Base Agents via Self-prompting and State-tracking

Nikolai Rozanov, Marek Rei

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.CL、cs.LG

Comments 9 pages, 5 pages appendix, 7 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16090 2025-02-25 cs.CL cs.AI cs.LG 75%

Echo: A Large Language Model with Temporal Episodic Memory

WenTao Liu, Ruohua Zhang, Aimin Zhou, Feng Gao, JiaLi Liu

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.07141 2020-08-19 cs.LG cs.AI cs.CL 75%

Working Memory Graphs

Ricky Loynd, Roland Fernandez, Asli Celikyilmaz, Adith Swaminathan, Matthew Hausknecht

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

Comments 11 pages, 6 figures, 7 page appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
1702.07826 2017-12-20 cs.AI cs.CL cs.HC cs.LG 75%

Rationalization: A Neural Machine Translation Approach to Generating Natural Language Explanations

Upol Ehsan, Brent Harrison, Larry Chan, Mark O. Riedl

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.CL、cs.LG

Comments 9 pages, 4 figures; added human evaluation section; added author; changed author order-Upol Ehsan and Brent Harrison both contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.13911 2021-06-29 cs.LG cs.AI 74%

Predictive Control Using Learned State Space Models via Rolling Horizon Evolution

Alvaro Ovalle, Simon M. Lucas

专题命中 记忆与上下文管理 :planning(abstract,comments);agent(abstract);分类 cs.AI、cs.LG

Comments Accepted at the Bridging the Gap Between AI Planning and Reinforcement Learning (PRL) Workshop at ICAPS 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13334 2026-08-14 cs.CL 新提交 74%

RippleMem: From Isolated Retrieval to Associative Recollection for Long-Term Agent Memory

RippleMem:从孤立检索到智能体长期记忆的关联回忆

Jingbo Ji, Lingyi Li, Xilong Cheng, Yuhao Zhou, Wenji Zhang, Yuting Tan, Yunxiao Qin

机构 * Communication University of China(中国传媒大学) Zhilian Yinghe Technology Co., Ltd.(智联映和科技有限公司) State Key Laboratory of Media Convergence and Communication(媒体融合与传播国家重点实验室)

专题命中 记忆与上下文管理 :agent(title);分类 cs.CL

AI总结 RippleMem是一种智能体长期记忆系统,以自适应关联回忆替代孤立检索,在LoCoMo、LongMemEval-S数据集上提升LLM-as-a-Judge准确率并降低图构建成本,性能优于现有方法。

Comments 22 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11879 2026-08-13 cs.CL cs.IR 新提交 74%

Total Recall at What Cost? Benchmarking the Serving Cost of Agentic Memory Systems

全量召回的代价是什么?智能体记忆系统的服务成本基准测试

Natchanon Pollertlam, Witchayut Kornsuwannawit

机构 * Bricks Technology(布里克科技)

专题命中 记忆与上下文管理 :agentic(title);分类 cs.CL

AI总结 本研究基准测试 Mem0 等三种智能体记忆系统的服务成本,对比固定窗口与全量重发策略,发现其成本受内部行为驱动,且无系统同时在成本与准确率上占优。

Comments 11 pages, 2 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03979 2026-08-05 cs.CV cs.AI 新提交 74%

Video-DeepResearch: Towards the Next-Generation Multimodal Deepresearch Agent

Video-DeepResearch:迈向新一代多模态深度研究智能体

Zhen Fang, Yu Zeng, Wenxuan Huang, Yiming Zhao, Shiting Huang, Tianfei Ren, Qi Lu, Qingnan Ren, Qisheng Su, Lionel Z. Wang, Qingyu Yin, Shuang Chen, Zehui Chen, Lin Chen, Zhenfei Yin, Yao Hu, Shaohui Lin, Wanli Ouyang, Shaosheng Cao, Feng Zhao

专题命中 记忆与上下文管理 :agent(title);分类 cs.AI

AI总结 该研究提出Video-DR智能体框架,通过解耦感知-探索流水线与分阶段工具解锁解决现有多模态模型的模态偏差和知识泄漏问题,构建基准并在视频问答任务上取得SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22690 2026-07-29 cs.AI 版本更新 74%

LazyMem: Retrieve Broadly, Construct Selectively for Efficient Long-Term Agent Memory

LazyMem:广泛检索,按需构建以实现高效长期智能体记忆

Jing Yu, Yibo Zhao, Jiaming Zhang, Xiang Li

机构 * School of Data Science and Engineering, East China Normal University(数据科学与工程学院,华东师范大学)

专题命中 记忆与上下文管理 :agent(title);分类 cs.AI

AI总结 研究针对大语言模型智能体长期记忆中原始对话历史的问题,提出LazyMem方法,将记忆构建推迟到查询时,通过轻量级模型处理候选池,经特定训练方式,在基准测试中取得高准确率,减少记忆令牌数和延迟。

Comments 29 pages, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17545 2026-07-22 cs.AI 版本更新 74%

Retain or Consolidate? Budget-Dependent Operator Selection for Language Agent Memory

保留还是合并?语言智能体记忆中依赖预算的算子选择

Qingcan Kang, Mingyang Liu, Shixiong Kai, Kaichao Liang, Zhentao Tang, Yuqi Cui, Tao Zhong, Mingxuan Yuan

专题命中 记忆与上下文管理 :agent(title);分类 cs.AI

AI总结 研究语言智能体记忆中预算依赖的算子选择问题,核心方法是将算子效用分解,用离线抽象安全机制实现,主要贡献是通过实验揭示在不同预算下保留和合并策略的适用情况及算子效果差异。

详情

展开后加载摘要…

URL PDF HTML 收藏