arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-05-18 至 2026-05-18 共收录 26 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 26 篇

2605.14892 2026-05-18 cs.AI 91%

Beyond Individual Intelligence: Surveying Collaboration, Failure Attribution, and Self-Evolution in LLM-based Multi-Agent Systems

超越个体智能:调查基于大语言模型的多智能体系统的协作、故障归因与自我进化

Shihao Qi, Jie Ma, Rui Xing, Wei Guo, Xiao Huang, Zhitao Gao, Jianhao Deng, Jun Liu, Lingling Zhang, Bifan Wei, Boqian Yang, Pinghui Wang, Jianwen Sun, Jing Tao, Yaqiang Wu, Hui Liu, Yu Yao, Tongliang Liu

机构 * MOE KLINNS Lab(MOE KLINNS实验室) School of Computer Science and Technology(计算机科学与技术学院) School of Cyber Science and Engineering(网络安全工程学院) School of Software Engineering(软件工程学院) School of Control Science and Engineering(控制科学与工程学院) Shaanxi Provincial Key Laboratory of Big Data Knowledge Engineering(陕西省大数据知识工程重点实验室) Laboratory for AI and New Forms of Education(人工智能与新型教育实验室) Lenovo AI Technology Center, CTOO, Lenovo(联想AI技术中心,联想CTOO) Sydney AI Centre, The University of Sydney(悉尼AI中心,悉尼大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract);tool use(abstract)

AI总结 本文探讨了基于大语言模型的多智能体系统中协作、故障归因与自我进化之间的因果关系,提出LIFE进展模型,系统分类各阶段并揭示其依赖与约束,为自适应多智能体系统提供理论框架和研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15611 2026-05-18 cs.AI 89%

TopoEvo: A Topology-Aware Self-Evolving Multi-Agent Framework for Root Cause Analysis in Microservices

TopoEvo: 一种面向拓扑的自演化多智能体框架用于微服务中的根本原因分析

Junle Wang, Xingchuang Liao, Wenjun Wu

机构 * School of Artificial Intelligence, Beihang University Beijing, China(人工智能学院,北京航空航天大学,北京,中国)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 针对微服务中观测数据异质性、故障传播和拓扑漂移问题,TopoEvo通过多模态对齐、拓扑约束推理和自演化机制,提升根本原因分析的鲁棒性与准确性。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15204 2026-05-18 cs.AI 89%

SDOF: Taming the Alignment Tax in Multi-Agent Orchestration with State-Constrained Dispatch

SDOF:通过状态约束调度驯服多智能体编排中的对齐税

Zhantao Wang

机构 * Digital China(数字中国)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 SDOF通过状态约束调度框架,利用强化学习和有限状态自动机提升多智能体任务执行的准确性和可控性,验证了其在招聘系统中的有效性。

Comments 12 pages, 4 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15799 2026-05-18 cs.MA cs.RO 89%

From Gridworlds to Warehouses: Adapting Lightweight One-shot Multi-Agent Pathfinding for AGVs

从网格世界到仓库:为AGVs适应轻量级一次性多智能体路径规划

Hiroki Nagai, Keisuke Okumura

机构 * National Institute of Advanced Industrial Science and Technology (AIST)(日本国家先进工业科学与技术研究院) Keio University(庆应大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 本文提出多智能体仓库路径规划(MAWPF),针对差分驱动AGVs的运动特性,引入四条约束条件,改进传统MAPF算法,通过实验验证PP和LNS2在多智能体场景下的不足,PIBT类方法在可扩展性上表现更优。

Comments To be presented at IJCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15573 2026-05-18 cs.CL cs.LG cs.MA 88%

Response-Conditioned Parallel-to-Sequential Orchestration for Multi-Agent Systems

响应条件化的并行到顺序 orchestration 用于多智能体系统

Nurbek Tastan, Alex Iacob, Lorenzo Sani, Meghdad Kurmanji, Nicholas D. Lane, Samuel Horvath, Karthik Nandakumar

机构 * MBZUAI(马克斯·普朗克智能系统研究所) University of Cambridge(剑桥大学) Flower Labs(Flower实验室) Michigan State University(密歇根州立大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL、cs.LG

AI总结 本文提出Nexa框架,通过响应条件化的策略结合并行与顺序执行,减少通信和延迟同时提高最终响应准确性,展示了其通用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10052 2026-05-18 cs.CL cs.AI 88%

Swarm Skills: A Portable, Self-Evolving Multi-Agent System Specification for Coordination Engineering

群体技能:一种可移植、自演化多智能体系统规范用于协调工程

Xinyu Zhang, Zhicheng Dou, Deyang Li, Jianjun Tao, Shuo Cheng, Ruifeng Shi, Fangchao Liu, Enrui Hu, Yangkai Ding, Hongbo Wang, Qi Ye, Xuefeng Jin, Zhangchun Zhao

机构 * openJiuwen Team(开放九文团队) Gaoling School of Artificial Intelligence, Renmin University of China(北京语言大学人工智能学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出Swarm Skills,一种扩展Anthropic Skills标准的多智能体规范,使多智能体工作流成为可分发的资产,通过内置语义结构实现自演化,无需人工干预。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09421 2026-05-18 cs.SE 88%

MACAA: Belief-Revision Multi-Agent Reasoning for Code Authorship Verification

MACAA:基于信念修正的多智能体推理用于代码作者身份验证

Jingwei Ye, Zhi Wang, Xin Li, Cong Gao, Chenbin Su, Jieshuai Yang, Jianfei Tang, Ge Chu

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.SE

AI总结 MACAA提出一种无需训练的多智能体框架,通过协调器和四个专家代理分析代码证据,提升代码作者身份验证的准确性和可审计性,实现89.15%的F1分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03161 2026-05-18 cs.CV cs.AI 88%

UniShield: An Adaptive Multi-Agent Framework for Unified Forgery Image Detection and Localization

UniShield: 一种适应性多智能体框架用于统一的伪造图像检测与定位

Qing Huang, Zhipei Xu, Xuanyu Zhang, Xiangyu Yu, Jian Zhang

机构 * School of Electronic and Computer Engineering, Peking University(北京大学电子与计算机工程学院) School of Future Technology, South China University of Technology(华南理工大学未来技术学院) School of Electronic and Information Engineering, South China University of Technology(华南理工大学电子与信息工程学院) Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology, Shenzhen Graduate School, Peking University(北京大学深圳研究生院超高清沉浸媒体技术省重点实验室)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 UniShield通过多智能体框架实现跨领域伪造图像检测与定位,提升检测的适应性和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10057 2026-05-18 cs.AI cs.MA 88%

STAR: Failure-Aware Markovian Routing for Multi-Agent Spatiotemporal Reasoning

STAR:面向多智能体时空推理的故障感知马尔可夫路由

Ruiyi Yang, Lihuan Li, Hao Xue, Flora D. Salim

机构 * University of New South Wales(新南威尔士大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 STAR通过故障感知路由框架提升多智能体时空推理性能,通过外部化智能体间控制实现状态条件下的转移策略,结合专家指定的常规路由与执行轨迹学习的恢复转换,提升错误状态下的恢复能力。

Comments 30 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16144 2026-05-18 eess.SP cs.MA cs.NI 88%

MAxLM: Multi-Agent Language Model-Based Scheduling and Resource Allocation in MU-MIMO-OFDMA-Enabled Wireless Networks

MAxLM:基于多智能体语言模型的MU-MIMO-OFDMA无线网络调度与资源分配

Adnan Quadri, Hongxiang Li

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出MAxLM框架,利用预训练语言模型优化无线网络的上行调度接入,通过WiSER平台实现自主调度与资源分配,实验表明其在不同STA数量和天线设置下均优于基准方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19732 2026-05-18 cs.MA 88%

Helix: A Dual-Helix Co-Evolutionary Multi-Agent System for Prompt Optimization and Question Reformulation

Helix:一种双螺旋协同进化多智能体系统用于提示优化和问题重述

Kewen Zhu, Liping Yi, Zhiming Zhao, Xiang Li, Qinghua Hu

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 Helix通过三阶段协同进化框架联合优化问题重述与提示指令,解决现有方法在提示模板固定、搜索空间有限及单向优化上的不足,实验表明其在12个基准上提升了3.95%的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15697 2026-05-18 cs.MA 88%

Distributed Zeroth-Order Policy Gradient for Networked Multi-agent Reinforcement Learning from Human Feedback

分布式零阶策略梯度用于人类反馈的网络多智能体强化学习

Pengcheng Dai, He Wang, Dongming Wang, Jian Qin, Wenwu Yu

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出一种分布式零阶策略梯度算法,利用人类反馈在无限时间 horizon 下实现多智能体协作优化,通过局部状态依赖网络实现高效 scalable 的多智能体强化学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11485 2026-05-18 cs.RO 88%

Coordinated Diffusion: Generating Multi-Agent Behavior Without Multi-Agent Demonstrations

协同扩散:无需多智能体演示生成多智能体行为

Lasse Peters, Laura Ferranti, Andrea Bajcsy, Javier Alonso-Mora

机构 * University of California, Berkeley(加州大学伯克利分校) Delft University of Technology(代尔夫特理工大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出Coordinated Diffusion框架,通过用户定义的多智能体成本函数将独立训练的单智能体扩散策略耦合,无需多智能体演示数据,实现多智能体行为协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15343 2026-05-18 cs.AI cs.LG cs.MA 87%

Belief Engine: Configurable and Inspectable Stance Dynamics in Multi-Agent LLM Deliberation

信念引擎:多智能体大语言模型协商中的可配置和可检查立场动态

Joshua C. Yang, Maurice Flechtner, Damian Dailisan, Michiel A. Bakker

机构 * ETH Zurich(苏黎世联邦理工学院) Centre for Democracy Studies Aarau, University of Zurich(苏黎世大学民主研究中心) Massachusetts Institute of Technology(麻省理工学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title);分类 cs.AI、cs.LG

AI总结 本文提出Belief Engine,通过可配置的信念更新机制,研究多智能体协商中的立场动态,揭示立场变化背后的证据吸收与锚定因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15873 2026-05-18 eess.SP 82%

Agent-Native Wireless Communications: Architecture, Opportunities, and the Road Ahead

面向代理的无线通信:架构、机遇与未来之路

Yuanwei Liu, Xu Gan, Zhaolin Wang, Shan Shan, Zongyao Zhao, Zhiguo Ding

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract)

AI总结 本文提出面向代理的无线通信框架,探讨代理智能与通信系统间的协同机制,涵盖通信系统设计与操作中的代理应用及无线服务支持,展望可测量、安全且互操作的部署方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15528 2026-05-18 cs.RO cs.MA 82%

Task-Semantic Graph-Driven Distributed Agent Networking for Underwater Target Tracking

基于任务语义的分布式智能体网络用于水下目标跟踪

Shengchao Zhu, Guangjie Han, Chuan Lin, Yu He

机构 * College of Computer Science and Software Engineering, Hohai University(河海大学计算机科学与软件工程学院) College of Information Science and Engineering, Hohai University(河海大学信息科学与工程学院) Software College, Northeastern University(东北大学软件学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract)

AI总结 本文提出STG-MAPPO算法,通过整合DI-engine与六自由度水下AUV仿真器,构建开放平台评估不同MARL算法,解决多智能体强化学习在水下目标跟踪中的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15503 2026-05-18 cs.CR 82%

uGen: An Agentic Framework for Generating Microarchitectural Attack PoCs

uGen:一种用于生成微架构攻击PoC的代理框架

Debopriya Roy Dipta, Thore Tiemann, Eduard Marin, Thomas Eisenbarth, Berk Gulmezoglu

专题命中 多智能体 :agentic(title);agent(abstract);multi-agent(abstract)

AI总结 本文提出uGen框架,利用LLM生成微架构攻击代码,解决现有方法的可移植性问题,通过多代理设计提升攻击代码的准确性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15202 2026-05-18 cs.AI cs.CL cs.IR 79%

DeepSlide: From Artifacts to Presentation Delivery

DeepSlide:从瑕疵到演示交付

Ming Yang, Zhiwei Zhang, Jiahang Li, Haoseng Liu, Yuzheng Cai, Weiguo Zheng

机构 * School of Data Science, Fudan University(复旦大学数据科学学院)

专题命中 多智能体 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 DeepSlide是一种人机协同的多智能体系统,旨在优化演示全过程,从需求获取到脚本生成,提升演示的动态表现力和叙事流畅性。

Comments 37 pages,10 figures,9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15918 2026-05-18 q-bio.QM 78%

The Impact of Heatwaves on Population Health: A Large Language Model-Enhanced Agent-Based Simulation

热浪对人口健康的影响:一种增强型大语言模型的群体模拟

Yuanhao Liu, Yuanfei Liu, Tian Lu, Hengyang Zhang, Zuowei Wang, Ying Dai

专题命中 多智能体 :agent(title,abstract)

AI总结 本文通过增强型大语言模型进行群体模拟,研究热浪对人口健康的影响,发现心理社会因素在社区韧性中的作用,并提出针对脆弱群体的干预措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08401 2026-05-18 cs.CL cs.AI 73%

AIPO: Learning to Reason from Active Interaction

AIPO: 通过主动交互学习推理

Junnan Liu, Linhao Luo, Thuy-Trang Vu, Gholamreza Haffari

机构 * Department of Data Science and AI, Faculty of Information Technology, Monash University, Australia(数据科学与人工智能系,信息科技学院,墨尔本大学,澳大利亚)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 AIPO通过主动多智能体交互提升大语言模型推理能力,引入三个协作代理解决推理瓶颈,改进探索效率并扩展能力边界。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15400 2026-05-18 cs.AI 70%

Beyond Partner Diversity: An Influence-Based Team Steering Framework for Zero-Shot Human-Machine Teaming

超越伙伴多样性:一种基于影响的团队引导框架用于零样本人机协同

Wei Sheng, Rohan Paleja

机构 * Department of Computer Science(计算机科学系)

专题命中 多智能体 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 本文提出基于影响的团队引导框架IBTS,通过影响塑造激励智能体发现多样化的高绩效团队交互模式,提升团队表现,强调需结合稀疏奖励协调机制与伙伴多样性覆盖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04745 2026-05-18 math.OC cs.AI cs.SY eess.SY nlin.AO 70%

Neural Policy Composition from Free Energy Minimization

从自由能最小化中学习神经策略组合

Francesca Rossi, Veronica Centorrino, Francesco Bullo, Giovanni Russo

机构 * Scuola Superiore Meridionale, Italy(意大利南部高级学院) ETH, Zürich(苏黎世联邦理工学院) Center for Control, Dynamical Systems, and Computation, UC Santa Barbara, CA, USA(加州大学圣巴巴拉分校控制与动力系统中心) Department of Information and Electrical Engineering and Applied Mathematics, University of Salerno, Italy(意大利萨勒诺大学信息与电气工程及应用数学系)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出了一种基于自由能最小化的框架,通过连续时间梯度流实现策略组合,并展示了其在多智能体系统、人类决策和控制基准中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03897 2026-05-18 cs.LG cs.DC 70%

On the Convergence Rates of Federated Q-Learning across Heterogeneous Environments

在异构环境中联邦Q学习的收敛速度研究

Leo Muxing Wang, Pengkun Yang, Lili Su

机构 * Northeastern University(东北大学) Tsinghua University(清华大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文研究了在异构环境中同步联邦Q学习的收敛速度,发现K增加时误差下降线性加速,但E>1会导致性能下降,证明了误差衰减速度为Θ(E/T)。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15962 2026-05-18 cs.CR 67%

PersonaFingerprint: Measuring Persona Inference on Modern Websites with LLM-Driven Browsing

PersonaFingerprint:基于LLM驱动浏览的现代网站人格推断测量

Chuxu Song, Hao Wang, Richard Martin

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文研究了现代网站中通过加密流量元数据推断用户人格的隐私风险,提出了一种基于LLM驱动的多代理浏览框架,并展示了在混合网站流量中人格推断的高准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15486 2026-05-18 cs.RO cs.AI 57%

Hybrid LLM-based Intelligent Framework for Robot Task Scheduling

基于混合大语言模型的智能机器人任务调度框架

Swayamjit Saha, Subhabrata Das, Haonan Duan, Xiao-Yang Liu

机构 * Department of Computer Science and Engineering, Mississippi State University(密苏里州立大学计算机科学与工程系) Graduate School of Arts and Sciences, Columbia University(哥伦比亚大学研究生院) Consumer and Community Banking, JPMorgan Chase(摩根大通消费与社区银行业) Department of Data Science, Columbia University(哥伦比亚大学数据科学系) Department of Electrical Engineering, Columbia University(哥伦比亚大学电气工程系)

专题命中 多智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出利用大语言模型提升建筑机器人任务调度效率,通过平衡时间效率与资源利用,结合自然语言处理接口实现与专业人员的实时沟通,并采用两个LLM代理生成更精确的任务计划。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15534 2026-05-18 math.OC cs.GT cs.SY eess.SY 50%

Distributionally Robust Nash Equilibrium Seeking with Partial Observations and Distributed Communication

具有部分观测和分布式通信的分布鲁棒纳什均衡寻求

Nirabhra Mandal, Sonia Martínez

专题命中 多智能体 :agent(abstract)

AI总结 研究了随机单次游戏,考虑样本共享和个体可访问两种情况,提出ISBRAG算法求解分布鲁棒纳什均衡,并通过模拟验证结果。

Comments 22 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏