arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-03 至 2026-06-03 共收录 298 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 94 篇

2505.08222 2026-06-03 cs.RO cs.AI cs.DC cs.PF 83%

Scaling Multi Agent Reinforcement Learning for Underwater Acoustic Tracking via Autonomous Vehicles

通过自主车辆扩展多智能体强化学习用于水声跟踪

Matteo Gallici, Ivan Masmitja, Mario Martín

机构 * KEMLG Research Group, Universitat Politècnica de Catalunya Barcelona, Spain(凯姆尔格研究组,巴塞罗那理工大学,西班牙) Instituto de Ciencias del Mar, Consejo Superior de Investigaciones Científicas, Barcelona, Spain(海洋科学研究所,西班牙国家科学研究委员会,巴塞罗那,西班牙) KEMLG Research Group, Universitat Politècnica de Catalunya (UPC), and with the HPAI group at Barcelona Supercomputing Center (BSC), Barcelona, Spain(凯姆尔格研究组,巴塞罗那理工大学(UPC),以及巴塞罗那超级计算中心(BSC)的HPAI组,巴塞罗那,西班牙)

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出一种GPU加速环境(高达30000倍加速)和基于Transformer的MARL架构(TransfMAPPO),实现多目标快速移动场景下的水下跟踪,跟踪误差低于5米。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03143 2026-06-03 cs.LG cs.CL 81%

FederatedSkill: Federated Learning for Agentic Skill Evolution

FederatedSkill: 面向智能体技能演化的联邦学习

Jingbo Yang, Guanyu Yao, Yang Zhang, Ramana Rao Kompella, Gaowen Liu, Shiyu Chang

机构 * UC Santa Barbara(加州大学圣巴bara分校) MIT-IBM Watson AI Lab(麻省理工-IBM Watson人工智能实验室) Cisco Research(思科研究)

专题命中 多智能体 :agentic(title);agent(abstract);分类 cs.CL、cs.LG

AI总结 提出FederatedSkill框架,通过语义技能差异作为通信单元,在保护隐私的同时实现个性化技能演化,相比自演化基线成功率提升44.4%,计算成本降低37.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
1302.6834 2026-06-03 cs.MA cs.SY eess.SY 78%

Models of Consensus for Multiple Agent Systems

多智能体系统的共识模型

Daniel E. O'Leary

专题命中 多智能体 :agent(title,abstract)

AI总结 本文使用解析模型(二项式模型)研究多智能体系统中的共识决策,分析智能体能力差异和先验概率不等对共识正确性的影响,并确定何时以及如何使用共识。

Comments Appears in Proceedings of the Tenth Conference on Uncertainty in Artificial Intelligence (UAI1994)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08426 2026-06-03 cs.GT cs.AI 77%

Mechanism Design Is Not Enough: Prosocial Agents for Cooperative AI

机制设计是不够的:面向合作AI的亲社会智能体

Xuanqiang Angelo Huang, Charlie Tharas, Samuele Marro, Van Q. Truong, Bernhard Schölkopf, Emanuele La Malfa, Zhijing Jin

机构 * ETH Zürich(苏黎世联邦理工学院) University of Oxford(牛津大学) Institute for Decentralized AI(去中心化人工智能研究所) Jinesis Lab, University of Toronto & Vector Institute(多伦多大学Jinesis实验室及向量研究所) EuroSafeAI University of Pennsylvania(宾夕法尼亚大学) Max Planck Institute for Intelligent Systems, Tübingen, Germany(德国图宾根最大计划智能系统研究所) ELLIS Institute Tübingen(图宾根ELLIS研究所)

专题命中 多智能体 :agent(abstract);AI agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文证明仅靠机制设计无法最大化LLM智能体的社会福利,并提出亲社会智能体(兼顾他人福利)能弥补这一差距,实现更优的社会与个体结果。

Comments 42 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05302 2026-06-03 cs.AI 77%

PieArena: Ranking and Profiling Language Agents in Realistic Negotiation Scenarios

PieArena:在真实谈判场景中对语言智能体进行排名与画像

Chris Zhu, Sasha Cui, Will Sanok Dufallo, Runzhi Jin, Zhen Xu, Linjun Zhang, Daylian Cain

机构 * Yale University(耶鲁大学) UC Berkeley(加州大学伯克利分校) BloomBerg(摩根大通) Rutgers University(罗格斯大学)

专题命中 多智能体 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出PieArena基准,通过多智能体交互评估LLM的谈判能力,并开发排名模型与行为画像,发现联合意图框架对中低端模型提升显著,前沿模型(如GPT-5)在谈判中达到或超过人类基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20508 2026-06-03 cs.MA cs.AI cs.CL 73%

Measuring Weak-to-Strong Legibility of Reasoning Models

衡量推理模型的弱到强可读性

Dani Roytburg, Shreya Sridhar, Daphne Ippolito

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 针对推理语言模型在多智能体场景中生成的中间思维链,提出“弱到强可读性”概念,并设计衡量指标以评估强模型输出对弱模型的易理解性。

Comments Accepted to Trustworthy AI4GOOD Workshop @ ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03876 2026-06-03 cs.HC cs.AI cs.MA 70%

From 'What' to 'How' and 'Why': Sharing LLM-Generated Retrospective Summaries of Older Adults' Passive Tracking Data with Remote Family Members

从“是什么”到“怎么样”和“为什么”:与远程家庭成员共享老年人被动追踪数据的LLM生成回顾性摘要

Jiachen Li, Reina Szeyi Chan, Akshat Choube, Xiang Zhi Tan, Elizabeth Mynatt, Varun Mishra

机构 * Northeastern University(东北大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本研究利用大型语言模型(LLM)从多模态追踪数据生成回顾性摘要,通过技术探针和访谈重新设计系统,显著提升了远程家庭成员对摘要的满意度、帮助性、信任和接收意愿,并提出了支持其从“是什么”到“怎么样”和“为什么”的认知转变的设计启示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03031 2026-06-03 cs.AI cs.MA cs.SC 70%

AUDITFLOW: Executable Symbolic Environments for Structured Financial Reporting Verification

AUDITFLOW:用于结构化财务报告验证的可执行符号环境

Yan Wang, Xuguang Ai, Jaisal Patel, Xueqing Peng, Fengran Mo, Yupeng Cao, Haohang Li, Mingyu Cao, Lingfei Qian, Víctor Gutiérrez-Basulto

机构 * The Fin AI Rensselaer Polytechnic Institute Université de Montréal Stevens Institute of Technology University of Surrey Cardiff University

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出基于图的多智能体框架AuditFlow,通过构建符号环境分离自适应搜索与确定性验证,在财务审计验证任务中实现82.09%的联合审计准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02641 2026-06-03 cs.RO cs.AI 70%

CARVE: Certified Affordable Repair of Vetoed Maneuvers via Envelopes for Interactive Driving

CARVE: 通过包络实现交互驾驶中被否决机动的认证可负担修复

Yifan Wang

机构 * Yifan Wang(王一帆)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 针对交互驾驶中规则感知堆栈易忽略的硬规则裕度负值问题,提出CARVE认证层,通过有限格点上的自我与代理战术算子,实现被否决机动的可负担修复认证,并证明其合理性。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17149 2026-06-03 cs.AI 70%

ProtocolBench: Which LLM MultiAgent Protocol to Choose?

ProtocolBench:选择哪个LLM多智能体协议?

Hongyi Du, Jiaqi Su, Jisen Li, Lijie Ding, Yingxuan Yang, Peixuan Han, Xiangru Tang, Kunlun Zhu, Jiaxuan You

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出ProtocolBench基准,系统比较多智能体协议在任务成功率、延迟、开销和鲁棒性上的表现,并设计可学习的协议路由器ProtocolRouter以动态选择最优协议。

Comments Accepted to ICML 2026. Camera-ready version.Code and benchmark artifacts: https://github.com/ulab-uiuc/AgentProtocols

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03543 2026-06-03 cs.MA 67%

D2MDT: Department-aware Multidisciplinary Team Consultation with Deliberation for Efficient Clinical Prediction

D2MDT:基于科室感知的多学科团队会诊与审议以实现高效临床预测

Yongqi Liang, Qidong Liu, Chunze Yang, Lei Wu, Jiusong Ge, Ni Zhang, Chen Li

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出D2MDT框架,通过构建结构化EHR证据和语义证据、分配科室视角给医生智能体、引入残差审议机制仅更新未解决共识,实现高效多学科会诊并提升临床预测性能。

Comments Preprint. 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03109 2026-06-03 quant-ph 67%

Game, Set, Quantum: Parameterized Quantum Circuit for Correlated Equilibrium in Bayesian Games

Game, Set, Quantum: 贝叶斯博弈中相关均衡的参数化量子电路

Param Pathak, Vidhi Oad, Nouhaila Innan, Adarsh Ganesan, Muhammad Shafique

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出一种混合量子-经典框架,使用参数化量子电路近似贝叶斯相关均衡,通过梯度基遗憾最小化训练,在扑克风格贝叶斯博弈中优于经典方法。

Comments 19 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1203.6606 2026-06-03 eess.SY cs.SY math.OC 67%

A Web Aggregation Approach for Distributed Randomized PageRank Algorithms

一种面向分布式随机PageRank算法的网页聚合方法

Hideaki Ishii, Roberto Tempo, Er-Wei Bai

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对分布式随机PageRank算法,提出一种利用网页稀疏性进行系统聚合的方法,通过计算聚合PageRank值并分配至组成员,降低计算与通信负载,并分析了收敛性。

Comments To appear in the IEEE Transactions on Automatic Control, 2012

详情

展开后加载摘要…

URL PDF HTML 收藏
1210.0056 2026-06-03 math.NA cs.DC cs.NA math.OC 67%

Convergence and Applications of a Gossip-based Gauss-Newton Algorithm

基于Gossip的高斯-牛顿算法的收敛性与应用

Xiao Li, Anna Scaglione

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出一种基于Gossip的分布式高斯-牛顿算法(GGN),适用于非凸目标问题,分析其收敛充分条件,数值实验表明性能接近集中式算法且在网络故障时性能优雅降级,优于其他分布式一阶方法。

Comments accepted by IEEE Transactions on Signal Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
1301.0170 2026-06-03 q-bio.QM cs.SY eess.SY q-bio.PE 67%

Noise-Induced Spatial Pattern Formation in Stochastic Reaction-Diffusion Systems

随机反应扩散系统中的噪声诱导空间模式形成

Yutaka Hori, Shinji Hara

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文通过线性噪声近似推导耦合多智能体系统,利用空间功率谱分析内在噪声,揭示噪声诱导图灵模式形成的机制,并用H2范数解释多智能体系统。

Journal ref Proceedings of IEEE Conference on Decision and Control, pp. 1053-1058, 2012

详情

展开后加载摘要…

URL PDF HTML 收藏
1104.4251 2026-06-03 cs.RO cs.MA cs.SY eess.SY math.OC 67%

Distributed Self-Organization Of Swarms To Find Globally $ε$-Optimal Routes To Locally Sensed Targets

群体分布式自组织以找到局部感知目标的全局$ε$-最优路径

Ishanu Chattopadhyay

专题命中 多智能体 :agent(abstract);planning(abstract)

AI总结 针对大规模群体,提出一种仅利用局部信息的分布式路径规划算法,通过信息渗透和梯度涌现实现接近最优的路径选择,并严格分析了收敛性、鲁棒性、可扩展性及系统参数的影响。

Comments 38 pages 10 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1104.0457 2026-06-03 math.OC cs.SY eess.SY 67%

Nonuniform Coverage Control on the Line

直线上的非均匀覆盖控制

Naomi Ehrich Leonard, Alex Olshevsky

专题命中 多智能体 :agent(abstract);autonomous agent(abstract)

AI总结 研究移动自主代理在非均匀场中通过分布式传感在直线上优化定位的控制律,提出两种全分布式算法,分别实现二次和线性复杂度的收敛,并对代理的丢失和添加具有鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
1101.3973 2026-06-03 math.CO cs.DS cs.SY eess.SY math.OC 67%

On cooperative patrolling: optimal trajectories, complexity analysis, and approximation algorithms

关于协同巡逻:最优轨迹、复杂性分析与近似算法

Fabio Pasqualetti, Antonio Franchi, Francesco Bullo

专题命中 多智能体 :agent(abstract);autonomous agent(abstract)

AI总结 本文研究利用自主智能体团队进行环境巡逻,提出链图、树图和循环图下的最优轨迹设计及分布式控制律,并给出多项式时间算法或NP-hard性证明及近似算法。

Comments Preprint submitted to IEEE Transaction on Robotics

Journal ref IEEE Transaction on Robotics, vol. 28, issue 3, pp. 592-606, 06/2012

详情

展开后加载摘要…

URL PDF HTML 收藏
1101.2002 2026-06-03 eess.SY cs.MA cs.SY 67%

Cooperative Tasking for Deterministic Specification Automata

确定性规范自动机的协同任务分配

Mohammad Karimadini, Hai Lin

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对多智能体系统,提出一种基于分治策略的全局规范分解方法,给出任意有限数量智能体任务可分解的充要条件,并证明局部规范满足可保证全局规范满足。

Comments Preprint, Submitted for publication

详情

展开后加载摘要…

URL PDF HTML 收藏
1005.2012 2026-06-03 math.OC cs.SY eess.SY stat.ML 67%

Dual Averaging for Distributed Optimization: Convergence Analysis and Network Scaling

分布式优化的对偶平均法:收敛分析与网络缩放

John Duchi, Alekh Agarwal, Martin Wainwright

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对网络上的分布式优化问题,提出基于次梯度对偶平均的分布式算法,并给出收敛速率关于网络规模和拓扑的尖锐界,证明迭代次数与网络谱间隙成反比。

Comments 40 pages, 4 figures

Journal ref IEEE Transactions on Automatic Control 57(3), pp. 592 - 606. March 2012

详情

展开后加载摘要…

URL PDF HTML 收藏
1304.1757 2026-06-03 math.OC cs.SY eess.SY 67%

Asynchronous Gossip-Based Random Projection Algorithms Over Networks

基于异步八卦的随机投影网络算法

Soomin Lee, Angelia Nedich

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对多智能体网络中的分布式约束凸优化问题,提出一种异步八卦随机投影算法,并证明其收敛性。

详情

展开后加载摘要…

URL PDF HTML 收藏
1303.2709 2026-06-03 eess.SY cs.SY 67%

Resilient Continuous-Time Consensus in Fractional Robust Networks

分数鲁棒网络中的弹性连续时间一致性

Heath J. LeBlanc, Haotian Zhang, Shreyas Sundaram, Xenofon Koutsoukos

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对存在敌手的多智能体系统,基于分数鲁棒性图论指标,研究正常智能体在切换拓扑下实现连续时间一致性的条件。

Comments to appear at the American Control Conference in June 2013

详情

展开后加载摘要…

URL PDF HTML 收藏
1208.2434 2026-06-03 math.OC cs.SY eess.SY 67%

Distributed Multi-objective Multidisciplinary Design Optimization Algorithms

分布式多目标多学科设计优化算法

Amir Noori

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出基于多智能体系统的并发工程设计优化框架,利用图论结构实现分布式共识与渐近收敛,达到局部和全局最优一致设计。

Comments Some of lemmas and assumptions, originate from arXiv:0802.3922, demonstrating the existing strong theoretical foundation and ensuring a complete statement of the problem at hand

详情

展开后加载摘要…

URL PDF HTML 收藏
1109.4960 2026-06-03 math.OC cs.SY eess.SY math.PR math.ST stat.TH 67%

Distributed Linear Parameter Estimation: Asymptotically Efficient Adaptive Strategies

分布式线性参数估计:渐近高效的自适应策略

Soummya Kar, Jose' M. F. Moura, H. Vincent Poor

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对多智能体推理网络中的分布式自适应线性参数估计问题,提出一种混合时间尺度随机过程,通过同时进行分布式学习和估计,使得智能体估计渐近达到集中式估计器的效率。

Comments Submitted to SIAM Journal on Control and Optimization journal. Initial Submission: Sept. 2011. Revised: Aug. 2012

详情

展开后加载摘要…

URL PDF HTML 收藏
1203.6599 2026-06-03 eess.SY cs.SY math.OC 67%

Distributed Randomized Algorithms for the PageRank Computation

分布式随机算法用于PageRank计算

Hideaki Ishii, Roberto Tempo

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对PageRank计算问题,提出了几种分布式随机算法,通过局部通信实现渐近均方收敛到真实PageRank值,并讨论了与多智能体一致性问题的紧密联系。

Journal ref IEEE Transactions on Automatic Control, 55: 1987-2002, 2010

详情

展开后加载摘要…

URL PDF HTML 收藏
1203.2563 2026-06-03 eess.SY cs.SY 67%

Average Consensus on General Strongly Connected Digraphs

一般强连通有向图上的平均一致性

Kai Cai, Hideaki Ishii

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对单向信息流的任意强连通有向图,提出两种分布式算法(确定性和随机性)实现状态平均,通过引入“盈余”变量并利用图论和非负矩阵工具分析收敛性。

详情

展开后加载摘要…

URL PDF HTML 收藏
1109.3948 2026-06-03 cs.MA cs.NI cs.SY eess.SY math.OC math.PR 67%

The Projection Method for Reaching Consensus and the Regularized Power Limit of a Stochastic Matrix

达成共识的投影方法与随机矩阵的正则化幂极限

R. P. Agaev, P. Yu. Chebotarev

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对多智能体系统中通信有向图不满足生成树条件时的离散共识问题,提出基于正交投影的协调方法,并证明该方法的矩阵可视为随机矩阵的正则化幂极限。

Comments 19 pages, 2 figures

Journal ref Automation and Remote Control, 2011, vol.72, No.12, P.2458-2476

详情

展开后加载摘要…

URL PDF HTML 收藏
0901.0633 2026-06-03 math.OC cs.SY eess.SY 67%

Optimal control as a graphical model inference problem

最优控制作为图模型推理问题

B. Kappen, V. Gomez, M. Opper

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 将Todorov (2007)提出的非线性随机最优控制问题重新表述为KL最小化问题,从而将最优控制计算转化为推理计算,并利用近似推理方法高效计算近似最优控制。

Comments 26 pages, 12 Figures; Machine Learning Journal (2012)

详情

展开后加载摘要…

URL PDF HTML 收藏
0910.5673 2026-06-03 math.OC cs.SY eess.SY math-ph math.DS math.MP 67%

Synchronization and Transient Stability in Power Networks and Non-Uniform Kuramoto Oscillators

电力网络与非均匀Kuramoto振子的同步与暂态稳定性

Florian Dorfler, Francesco Bullo

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 利用奇异摄动分析建立电力网络模型与非均匀Kuramoto振子模型之间的等价关系,并推导出同步与暂态稳定性的代数条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
1001.2612 2026-06-03 math.OC cs.SY eess.SY 67%

On distributed convex optimization under inequality and equality constraints via primal-dual subgradient methods

基于原始-对偶次梯度方法的不等式与等式约束下的分布式凸优化

Minghui Zhu, Sonia Martinez

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对带全局不等式、等式及集合约束的多智能体凸优化问题,提出两种分布式原始-对偶次梯度算法,利用拉格朗日函数和惩罚函数的鞍点特性,在时变拓扑网络下实现渐近一致最优解与最优值。

Comments 44 pages

详情

展开后加载摘要…

URL PDF HTML 收藏