arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35313 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35313 篇

2102.12957 2021-02-26 cs.LG cs.AI cs.MA 88%

Credit Assignment with Meta-Policy Gradient for Multi-Agent Reinforcement Learning

Jianzhun Shao, Hongchang Zhang, Yuhang Jiang, Shuncheng He, Xiangyang Ji

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.08001 2021-02-09 cs.LG cs.AI 88%

UPDeT: Universal Multi-agent Reinforcement Learning via Policy Decoupling with Transformers

Siyi Hu, Fengda Zhu, Xiaojun Chang, Xiaodan Liang

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.01022 2021-01-06 cs.LG cs.AI cs.MA stat.ML 88%

Health-Informed Policy Gradients for Multi-Agent Reinforcement Learning

Ross E. Allen, Jayesh K. Gupta, Jaime Pena, Yutai Zhou, Javona White Bear, Mykel J. Kochenderfer

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.02964 2020-11-17 cs.MA cs.AI cs.LG 88%

Multi-Objective Multi-Agent Decision Making: A Utility-based Analysis and Survey

Roxana Rădulescu, Patrick Mannion, Diederik M. Roijers, Ann Nowé

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

Comments Under review since 15 May 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.09453 2020-05-21 cs.LG cs.AI cs.MA 88%

Experience Augmentation: Boosting and Accelerating Off-Policy Multi-Agent Reinforcement Learning

Zhenhui Ye, Yining Chen, Guanghua Song, Bowei Yang, Shen Fan

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

Comments 10 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2004.03809 2020-04-24 cs.CL cs.LG 88%

Multi-Agent Task-Oriented Dialog Policy Learning with Role-Aware Reward Decomposition

Ryuichi Takanobu, Runze Liang, Minlie Huang

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL、cs.LG

Comments ACL 2020 long paper

详情

展开后加载摘要…

URL PDF HTML 收藏
1901.09216 2020-01-22 cs.AI cs.LG cs.MA 88%

Modelling Bounded Rationality in Multi-Agent Interactions by Generalized Recursive Reasoning

Ying Wen, Yaodong Yang, Rui Luo, Jun Wang

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.08190 2020-01-10 cs.LG cs.AI cs.RO 88%

Control What You Can: Intrinsically Motivated Task-Planning Agent

Sebastian Blaes, Marin Vlastelica Pogančić, Jia-Jie Zhu, Georg Martius

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.12557 2019-11-28 cs.LG cs.AI cs.MA stat.ML 88%

Multi-Agent Actor-Critic with Hierarchical Graph Attention Network

Heechang Ryu, Hayong Shin, Jinkyoo Park

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

Comments Accepted as a conference paper at the Thirty-Fourth AAAI Conference on Artificial Intelligence (AAAI-20), New York, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.09508 2019-10-22 cs.MA cs.AI cs.LG 88%

Multi-agent Hierarchical Reinforcement Learning with Dynamic Termination

Dongge Han, Wendelin Boehmer, Michael Wooldridge, Alex Rogers

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

Comments PRICAI 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1908.05224 2019-10-09 cs.RO cs.AI cs.LG 88%

Multi-Agent Manipulation via Locomotion using Hierarchical Sim2Real

Ofir Nachum, Michael Ahn, Hugo Ponte, Shixiang Gu, Vikash Kumar

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1901.08004 2019-06-24 cs.LG cs.AI 88%

Hierarchical Reinforcement Learning for Multi-agent MOBA Game

Zhijian Zhang, Haozheng Li, Luo Zhang, Tianyin Zheng, Ting Zhang, Xiong Hao, Xiaoxin Chen, Min Chen, Fangxu Xiao, Wei Zhou

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

Comments 7 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1901.09207 2019-03-04 cs.LG cs.AI stat.ML 88%

Probabilistic Recursive Reasoning for Multi-Agent Reinforcement Learning

Ying Wen, Yaodong Yang, Rui Luo, Jun Wang, Wei Pan

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

Comments ICLR 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1805.08776 2018-05-24 cs.LG cs.AI cs.MA stat.ML 88%

Scalable Centralized Deep Multi-Agent Reinforcement Learning via Policy Gradients

Arbaaz Khan, Clark Zhang, Daniel D. Lee, Vijay Kumar, Alejandro Ribeiro

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21710 2026-01-07 cs.CL 88%

Think-on-Graph 3.0: Efficient and Adaptive LLM Reasoning on Heterogeneous Graphs via Multi-Agent Dual-Evolving Context Retrieval

Think-on-Graph 3.0: 通过多智能体双进化上下文检索实现高效自适应的异构图LLM推理

Xiaojun Wu, Cehao Yang, Xueyuan Lin, Chengjin Xu, Xuhui Jiang, Yuanliang Sun, Hui Xiong, Jia Li, Jian Guo

机构 * IDEA Research, International Digital Economy Academy(IDEA研究院,国际数字经济学院) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) DataArc Tech Ltd.(数据弧科技有限公司) Hithink RoyalFlush Information Network Co., Ltd(慧思皇家Flush信息网络有限公司)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 Think-on-Graph 3.0通过多智能体双进化上下文检索机制,实现高效自适应的异构图LLM推理,提升轻量级模型在复杂推理任务中的性能。

Comments add: reranker agent and experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.13446 2021-05-07 cs.LG cs.MA 88%

Semi-On-Policy Training for Sample Efficient Multi-Agent Policy Gradients

Bozhidar Vasilev, Tarun Gupta, Bei Peng, Shimon Whiteson

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG;autonomous agent(comments)

Comments AAMAS Adaptive and Learning Agents Workshop. 20th International Conference on Autonomous Agents and Multiagent Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.04517 2018-02-09 cs.AI cs.CY cs.HC 88%

Visualizations for an Explainable Planning Agent

Tathagata Chakraborti, Kshitij P. Fadnis, Kartik Talamadupula, Mishal Dholakia, Biplav Srivastava, Jeffrey O. Kephart, Rachel K. E. Bellamy

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);分类 cs.AI

Comments PREVIOUSLY Mr. Jones -- Towards a Proactive Smart Room Orchestrator (appeared in AAAI 2017 Fall Symposium on Human-Agent Groups)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11844 2026-08-05 cs.CV 版本更新 88%

Beyond the Single Camera: Agentic Multi-View Reasoning in Sports Video Understanding

超越单摄像头:体育视频理解中的智能多视角推理

Kerui Chen, Jinglu Wang, Xiaoyi Zhang, Yan Lu

机构 * Zhejiang University(浙江大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 规划决策 :agent(summary_cn,abstract);agentic(title,abstract)

AI总结 针对体育视频多视角理解缺乏评估基准及MLLMs难以利用多视角信息的问题,引入SportMV - Bench基准,分析瓶颈所在,并提出SportMV - Agent框架,通过迭代循环实现主动视角选择等,相比最强MLLM基线有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28822 2026-08-03 eess.SY cs.SY 新提交 88%

Agentic Artificial Intelligence for Power Systems: Strategies to Identify and Close Capability Gaps

面向电力系统的智能体人工智能:识别与缩小能力差距的策略

Eve Tsybina, Samim Konjicija, Slaven Peles

专题命中 规划决策 :agentic(title,summary_cn);planning(abstract)

AI总结 该研究针对电力系统规划任务,复现当前最优Agentic AI并评估其能力,发现其仅能解决部分低复杂度问题,明确了能力升级需求,强调需采用严格测试与可复现基准评估Agentic AI进展。

Comments 5 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15710 2026-04-20 cs.SD 88%

VoxMind: An End-to-End Agentic Spoken Dialogue System

VoxMind:一个端到端的智能语音对话系统

Tianle Liang, Yifu Chen, Shengpeng Ji, Yijun Chen, Zhiyang Jia, Jingyu Lu, Fan Zhuo, Xueyi Pu, Yangzhuo Li, Zhou Zhao

机构 * Zhejiang University(浙江大学) China University of Petroleum-Beijing at Karamay(中国石油大学(北京)克拉玛依校区) Xiamen University(厦门大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);tool use(abstract);planning(abstract)

AI总结 本文提出VoxMind,通过引入智能代理能力,提升端到端语音对话系统在复杂任务中的表现,实验表明其任务完成率显著提高。

Comments Accepted to ACL 2026 Main Conference.Code and data available at https://github.com/MM-Speech/VoxMind

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01891 2026-04-07 cs.CV 88%

Agentic AI in Remote Sensing: Foundations, Taxonomy, and Emerging Systems

遥感中的代理AI:基础、分类与新兴系统

Niloufar Alipour Talemi, Julia Boone, Fatemeh Afghah

机构 * Clemson University(克莱姆森大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);autonomous agent(abstract);planning(abstract)

AI总结 本文探讨遥感中代理AI的基础、分类及新兴系统,提出统一的分类框架,分析规划机制、检索增强生成和记忆结构,并评估轨迹感知推理的准确性。

Comments Accepted to the IEEE/CVF Winter Conference on Applications of Computer Vision (WACV) 2026, GeoCV Workshop

Journal ref Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision (WACV) Workshops, 2026, pp. 786-799

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06299 2026-01-23 cs.CY cs.AI cs.CL cs.LG 88%

How malicious AI swarms can threaten democracy: The fusion of agentic AI and LLMs marks a new frontier in information warfare

恶意AI群如何威胁民主:代理AI与大语言模型的融合标志着信息战争的新前沿

Daniel Thilo Schroeder, Meeyoung Cha, Andrea Baronchelli, Nick Bostrom, Nicholas A. Christakis, David Garcia, Amit Goldenberg, Yara Kyrychenko, Kevin Leyton-Brown, Nina Lutz, Gary Marcus, Filippo Menczer, Gordon Pennycook, David G. Rand, Maria Ressa, Frank Schweitzer, Dawn Song, Christopher Summerfield, Audrey Tang, Jay J. Van Bavel, Sander van der Linden, Jonas R. Kunst

机构 * Department of Sustainable Communication Technologies, SINTEF Digital(可持续通信技术系,SINTEF数字) Max Planck Institute for Security and Privacy(安全与隐私研究所) Department of Mathematics, City St George’s University of London(数学系,圣乔治大学) Macrostrategy Research Initiative(战略研究计划) Human Nature Lab, Yale University(人性实验室,耶鲁大学) Department of Politics and Public Administration, University of Konstanz(政治与公共管理系,康斯坦茨大学) Harvard Business School, Harvard University(哈佛商学院,哈佛大学) Department of Psychology, University of Cambridge(心理学系,剑桥大学) Department of Computer Science, University of British Columbia(计算机科学系,不列颠哥伦比亚大学) Department of Human Centered Design & Engineering, University of Washington(以人为本设计与工程系,华盛顿大学) Department of Psychology, New York University(心理学系,纽约大学) Observatory on Social Media and Luddy School of Informatics, Computing, and Engineering, Indiana University(社交媒体观察所和信息、计算与工程学院,印第安纳大学)

专题命中 规划决策 :agentic(title);agent(abstract);AI agent(abstract);autonomous agent(abstract)

AI总结 本文探讨了恶意AI群通过融合代理AI与大语言模型对民主构成的威胁,并提出多方面的干预措施。

Comments 5 Pages, This is the author's version of the work. It is posted here by permission of the AAAS for personal use, not for redistribution. The definitive version was published in Science on January 22, 2026, DOI: 10.1126/science.adz1697

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16970 2025-12-22 cs.AI cs.CL cs.LG cs.MA 88%

PAACE: A Plan-Aware Automated Agent Context Engineering Framework

PAACE:一种计划感知的自动代理上下文工程框架

Kamer Ali Yuksel

机构 * Kamer Ali Yuksel(独立研究者)

专题命中 规划决策 :agent(title,abstract);tool use(abstract);planning(abstract);agentic(abstract)

AI总结 PAACE通过计划感知的上下文工程框架提升LLM代理的准确性并减少上下文负载,实现高效多步骤任务处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18114 2025-11-25 cs.CR 88%

ASTRA: Agentic Steerability and Risk Assessment Framework

ASTRA:代理可引导性与风险评估框架

Itay Hazan, Yael Mathov, Guy Shtar, Ron Bitton, Itsik Mantin

专题命中 规划决策 :agentic(title,abstract);agent(abstract);AI agent(abstract);autonomous agent(abstract)

AI总结 ASTRA框架通过模拟多种AI代理并测试其对新型攻击的防御能力,评估LLM在构建安全代理中的有效性,推动更安全的AI系统发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13068 2025-06-18 cs.MA 88%

Towards the Autonomous Optimization of Urban Logistics: Training Generative AI with Scientific Tools via Agentic Digital Twins and Model Context Protocol

Haowen Xu, Yulin Sun, Jose Tupayachi, Olufemi Omitaomu, Sisi Zlatanova, Xueping Li

专题命中 规划决策 :agentic(title,abstract);agent(abstract);AI agent(abstract);planning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09458 2025-12-11 cs.AI cs.LG 88%

Architectures for Building Agentic AI

构建代理AI的架构

Sławomir Nowaczyk

机构 * Center for Applied Intelligent Systems Research, Halmstad University, Sweden(应用智能系统研究所,哈尔姆斯塔德大学,瑞典)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文提出了一种构建代理AI的架构分类,通过组件化设计和显式控制循环提升系统可靠性。

Comments This is a preprint of a chapter accepted for publication in Generative and Agentic AI Reliability: Architectures, Challenges, and Trust for Autonomous Systems, published by Springer Nature

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10330 2026-08-12 cs.AI 新提交 88%

Hierarchical Compositionality for An Assistive AI Agent

面向辅助AI智能体的分层组合性

Tianyi Fu, Mohan Sridharan

机构 * University of Edinburgh(爱丁堡大学)

专题命中 规划决策 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

AI总结 本文针对辅助AI智能体的歧义问题,提出嵌入分层组合性原则的架构,结合语义兼容性等模型推理实现歧义消除,实验表明其性能优于当前最优数据驱动基线,可适配特定用户画像。

Comments 25 pages, 9 figures, 4 tables. Project page: https://tianyi-fu.github.io/HCAA

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09524 2026-08-11 cs.CR cs.AI 新提交 88%

STAIR: Effective Incident Response Using an End-to-End Agentic Planning Framework

STAIR:使用端到端智能体规划框架的有效事件响应

Hanlin Jiang, Jionghao Huang, Shaofei Li, Bojia Yu, Peng Jiang, Yuxin Ren, Ning Jia, Yao Guo, Ding Li

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 针对事件响应规划的静态工作流和现有LLM智能体的不足,提出端到端智能体规划框架STAIR,在100个Docker网络靶场中实现0.94标准化防御得分,较最强基线提升9.5%。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02876 2026-08-05 cs.AI 新提交 88%

BAP-SQL: Budget-Aware Observation Planning for Agentic Text-to-SQL

BAP-SQL:面向智能体Text-to-SQL的预算感知观测规划

Chong Peng, Pin Qian, Su Wang, Yihang Chen, Varun Sah

机构 * Microsoft(微软公司) Carnegie Mellon University(卡内基梅隆大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 BAP-SQL是面向智能体Text-to-SQL的预算感知观测规划方法,通过将观测形成作为预算控制阶段,在紧预算下提升了SQL生成成功率,同时减少了token使用量。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22643 2026-07-28 cs.AI cs.CV 新提交 88%

Reason Before You Retrieve: Agentic Planning for Multi-modal RAG

检索前先思考:多模态检索增强生成的智能体规划

Tianyu Yang, Shir Simon, Zhenzhen Li, Minhao Cheng, Xiangliang Zhang

机构 * Bosch AI Research Center(博世人工智能研究中心) University of Notre Dame(圣母大学) Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 规划决策 :agentic(title,abstract);planning(title);agent(abstract);分类 cs.AI

AI总结 研究多模态检索增强生成问题,提出MM-R2框架,通过建模检索内容和位置在检索前推理,构建意图基础检索状态,在结构化知识图谱检索,还构建相关数据集并采用两阶段后训练策略,实验证明其在答案准确性等方面表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏