arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-05 至 2026-03-05 共收录 11 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 11 篇

2410.19450 2026-03-05 cs.AI 88%

Offline-to-Online Multi-Agent Reinforcement Learning with Offline Value Function Memory and Sequential Exploration

离线到在线多智能体强化学习:结合离线价值函数记忆与序列探索

Hai Zhong, Xun Wang, Zhuoran Li, Longbo Huang

机构 * IIIS, Tsinghua University(清华大学人工智能研究院)

专题命中 记忆与上下文管理 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 OVMSE通过离线价值函数记忆和序列探索策略,在多智能体强化学习中提升样本效率和性能。

Comments Include detailed hyperparameter configurations

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04241 2026-03-05 cs.AI cs.LG 81%

Agentics 2.0: Logical Transduction Algebra for Agentic Data Workflows

Agentics 2.0:逻辑转导代数用于代理数据工作流

Alfio Massimiliano Gliozzo, Junkyu Lee, Nahuel Defosse

机构 * IBM(国际商业机器公司)

专题命中 记忆与上下文管理 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 Agentics 2.0通过逻辑转导代数构建高质量、可解释且类型安全的代理数据工作流,展示了在数据驱动发现和NL到SQL语义解析中的先进性能。

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03302 2026-03-05 cs.CL cs.AI cs.IR 73%

Developing an AI Assistant for Knowledge Management and Workforce Training in State DOTs

为州交通部门的知识管理和员工培训开发人工智能助手

Divija Amaram, Lu Gao, Gowtham Reddy Gudla, Tejaswini Sanjay Katale

机构 * Department of Computer Science, University of Houston(计算机科学系,休斯顿大学) Department of Civil and Environmental Engineering, University of Houston(土木与环境工程系,休斯顿大学) Ph.D Department of Civil and Environmental Engineering, University of Houston(土木与环境工程系,休斯顿大学) Engineering Data Science, University of Houston(工程数据科学,休斯顿大学)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出了一种多代理架构的RAG框架,用于州交通部门的知识管理和决策支持,通过整合文档检索与大语言模型生成,提升信息检索与响应质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03290 2026-03-05 cs.CL cs.AI cs.IR cs.LG 67%

AriadneMem: Threading the Maze of Lifelong Memory for LLM Agents

AriadneMem: 为LLM代理梳理终身记忆的迷宫

Wenhui Zhu, Xiwen Chen, Zhipeng Wang, Jingjing Wang, Xuanzhao Dong, Minzhou Huang, Rui Cai, Hejian Sang, Hao Wang, Peijie Qiu, Yueyue Deng, Prayag Tiwari, Brendan Hogan Rappazzo, Yalin Wang

机构 * Arizona State University(亚利桑那州立大学) Morgan Stanley(摩根大通) Rice University(里奇大学) Clemson University(克莱姆森大学) Northwestern University(西北大学) UC Davis(加州大学戴维斯分校) Iowa State University(爱荷华州立大学) Washington University in St. Louis(圣路易斯华盛顿大学) Columbia University(哥伦比亚大学) Halmstad University(哈马格大学)

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 AriadneMem通过解耦的两阶段流程提升LLM代理在长期对话中的多跳和平均F1表现,同时减少运行时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06531 2026-03-05 cs.LG cs.AI 62%

Unraveling the Complexity of Memory in RL Agents: an Approach for Classification and Evaluation

揭示强化学习智能体记忆复杂性:一种分类与评估的方法

Egor Cherepanov, Nikita Kachaev, Artem Zholus, Alexey K. Kovalev, Aleksandr I. Panov

机构 * AXXX MIRIAI ITMO University AI Talent Hub(ITMO大学AI人才中心) Mila – Quebec AI Institute(魁北克AI研究所) Polytechnique Montréal(蒙特利尔理工学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过定义智能体记忆类型(如长期vs短期、陈述性vs程序性记忆)来简化强化学习中的记忆概念,并通过实验方法评估不同智能体的记忆能力。

Comments 20 pages, 6 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09459 2026-03-05 cs.LG cs.AI 62%

Recurrent Action Transformer with Memory

具有记忆的递归动作变换器

Egor Cherepanov, Alexey Staroverov, Alexey K. Kovalev, Aleksandr I. Panov

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出具有记忆的递归动作变换器(RATE),通过引入递归记忆机制提升离线强化学习中对长序列和内存密集型任务的处理能力。

Comments 29 pages, 22 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03296 2026-03-05 cs.CL cs.AI cs.IR 62%

PlugMem: A Task-Agnostic Plugin Memory Module for LLM Agents

PlugMem: 一种通用插件记忆模块用于LLM代理

Ke Yang, Zixi Chen, Xuan He, Jize Jiang, Michel Galley, Chenglong Wang, Jianfeng Gao, Jiawei Han, ChengXiang Zhai

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Tsinghua University(清华大学) Microsoft Research(微软研究院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

AI总结 PlugMem是一种通用记忆模块,通过知识中心的记忆图结构提升LLM代理在复杂任务中的记忆检索与推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03781 2026-03-05 cs.AI 57%

LifeBench: A Benchmark for Long-Horizon Multi-Source Memory

LifeBench: 一个用于长周期多源记忆的基准

Zihao Cheng, Weixin Wang, Yu Zhao, Ziyang Ren, Jiaxuan Chen, Ruiyang Xu, Shuai Huang, Yang Chen, Guowei Li, Mengshi Wang, Yi Xie, Ren Zhu, Zeren Jiang, Keda Lu, Yihong Li, Xiaoliang Wang, Liwei Liu, Cam-Tu Nguyen

机构 * Institute for Clarity in Documentation(清晰文档研究所) Inria Paris-Rocquencourt(巴黎-罗克琴库特研究所) Rajiv Gandhi University(拉贾夫·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室) State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) School of Artificial Intelligence, Nanjing University(人工智能学院,南京大学) Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.AI

AI总结 Lifebench是一个用于长周期多源记忆的基准,通过密集连接的长周期事件模拟,推动AI代理在多样且时间延长的上下文中整合声明性和非声明性记忆推理。

Comments A total of 28 pages, 8 pages of main text, and 15 figures and tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03633 2026-03-05 cs.CR cs.AI 57%

Goal-Driven Risk Assessment for LLM-Powered Systems: A Healthcare Case Study

面向目标的风险评估用于LLM驱动系统:一个医疗案例研究

Neha Nagaraja, Hayretdin Bahsi

机构 * School of Informatics, Computing, and Cyber Systems(信息学、计算与网络系统学院) Northern Arizona University(北亚利桑那大学) Department of Software Science(软件科学系) Tallinn University of Technology(塔林技术大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文提出了一种面向目标的风险评估方法,用于评估LLM驱动系统的安全风险,通过攻击树详细分析威胁向量和攻击路径,以提升医疗系统等复杂系统的安全性。

Comments To appear in the HealthSec Workshop at the 2025 IEEE Annual Computer Security Applications Conference (ACSAC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02862 2026-03-05 cs.LG 57%

Learning in Markov Decision Processes with Exogenous Dynamics

在外生动态中学习马尔可夫决策过程

Davide Maran, Davide Salaorni, Marcello Restelli

机构 * Department of DEIB, Politecnico di Milano, Milan, Italy(米兰理工大学DEIB部门)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.LG

AI总结 本文提出了一种在具有外生动态的马尔可夫决策过程中学习的方法,通过利用外生状态组件的独立性,提高了学习保证和样本效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04254 2026-03-05 cs.CV 50%

EmbodiedSplat: Online Feed-Forward Semantic 3DGS for Open-Vocabulary 3D Scene Understanding

EmbodiedSplat: 在线前馈语义3DGS用于开放词汇3D场景理解

Seungjun Lee, Zihan Wang, Yunsong Wang, Gim Hee Lee

机构 * National University of Singapore(新加坡国立大学)

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 EmbodiedSplat通过在线前馈3DGS实现开放词汇3D场景理解,结合CLIP编码和3D U-Net提升语义重建效率与泛化能力。

Comments CVPR 2026, Project Page: https://0nandon.github.io/EmbodiedSplat/

详情

展开后加载摘要…

URL PDF HTML 收藏