arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-05-11 至 2026-05-11 共收录 34 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 34 篇

2605.05949 2026-05-11 cs.AI cs.SE 92%

MAS-Algorithm: A Workflow for Solving Algorithmic Programming Problems with a Multi-Agent System

MAS-Algorithm: 一个基于多智能体系统的算法问题求解工作流

Yuliang Xu, Xiang Xu, Yao Wan, Hu Wei, Tong Jia

机构 * Peking University(北京大学) Alibaba Group(阿里巴巴集团) Huazhong University of Science and Technology(华中科技大学)

专题命中 多智能体 :agent(title,abstract);workflow(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.SE

AI总结 本文提出MAS-Algorithm,通过多智能体工作流提升算法问题求解能力,实验显示在多个模型上均取得显著提升,包括接受率提升6.48%和LiveCodeBench-Pro上的4.72%提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16876 2026-05-11 cs.CV cs.AI cs.LG 91%

Multi-Modal Multi-Agent Reinforcement Learning for Radiology Report Generation

多模态多智能体强化学习在放射学报告生成中的应用

Kaito Baba, Risa Kishikawa, Satoshi Kodera

机构 * Department of Cardiovascular Medicine(心血管医学科)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);agentic(abstract)

AI总结 本文提出MARL-Rad框架,通过多智能体强化学习提升放射学报告生成的临床效果,通过联合优化区域特定智能体和全局整合智能体,提高报告的准确性和一致性。

Comments 23 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06696 2026-05-11 cs.AI cs.LG cs.MA 90%

Hidden Coalitions in Multi-Agent AI: A Spectral Diagnostic from Internal Representations

多智能体AI中的隐藏联盟:来自内部表示的谱诊断

Cameron Berg, Susan L. Schneider, Mark M. Bailey

机构 * Reciprocal Research(递归研究) Center for the Future of AI, Mind, and Society(人工智能、心智与社会未来中心) Florida Atlantic University(佛罗里达 Atlantic 大学) Biological and Computational Intelligence Center(生物与计算智能中心) National Intelligence University(国家情报大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);AI agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过分析多智能体系统内部神经表示的谱分区方法,检测隐藏联盟结构,验证了该方法在强化学习和大语言模型中的有效性,揭示了代表层次结构。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07646 2026-05-11 cs.CL cs.AI cs.LG 89%

MAVEN: Multi-Agent Verification-Elaboration Network with In-Step Epistemic Auditing

MAVEN:具有步骤内认知审计的多智能体验证-扩展网络

Yinsheng Yao, Jiehao Tang, Zhaozhen Yang, Dawei Cheng

机构 * Tongji University(同济大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 MAVEN通过显式角色解耦将LLM转化为有意识的推理者,采用对抗性Skeptic-Researcher-Judge循环,生成可验证的模块化推理轨迹,提升多任务推理质量。

Comments 24 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06623 2026-05-11 cs.AI cs.CL cs.LG cs.MA 89%

MASPO: Joint Prompt Optimization for LLM-based Multi-Agent Systems

MASPO:基于大语言模型的多智能体系统的联合提示优化

Zhexuan Wang, Xuebo Liu, Li Wang, Zifei Shan, Yutong Wang, Zhenxi Song, Min Zhang

机构 * Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳研究院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出MASPO框架,通过联合评估机制和数据驱动的进化束搜索,优化多智能体系统中的提示,提升整体性能,实验显示在6个任务中平均准确率提升2.9。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01041 2026-05-11 cs.MA cs.AI cs.GT cs.LG cs.RO 88%

Separation Assurance between Heterogeneous Fleets of Small Unmanned Aerial Systems via Multi-Agent Reinforcement Learning

通过多智能体强化学习实现异构小型无人机编队的分离保障

Iman Sharifi, Hyeong Tae Kim, Maheed Hatem Ahmed, Mahsa Ghasemi, Peng Wei

机构 * Department of Mechanical and Aerospace Engineering, George Washington University(机械与航空航天工程系,乔治华盛顿大学) Department of Electrical and Computer Engineering, Purdue University(电气与计算机工程系,普渡大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文通过多智能体强化学习方法,研究异构小型无人机编队在战术解冲突中的均衡问题,并探讨政策对不同配置编队的影响,验证了PPOA2C框架在安全分离中的有效性。

Comments 8 pages, 3 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05703 2026-05-11 cs.MA cs.AI cs.LG 88%

Active Learning for Communication Structure Optimization in LLM-Based Multi-Agent Systems

基于大语言模型多智能体系统的通信结构优化的主动学习

Huchen Yang, Xinghao Dong, Dan Negrut, Jin-Long Wu

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于信息论的任务选择框架,通过估计任务信息量优化多智能体系统通信结构,在有限预算下提升性能并减少token使用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07472 2026-05-11 cs.CR cs.AI cs.MA 88%

HBEE: Human Behavioral Entropy Engine -- Pre-Registered Multi-Agent LLM Simulation of Peer-Suspicion-Based Detection Inversion

HBEE:人类行为熵引擎——预注册的多智能体LLM模拟中的基于同伴怀疑的检测反转

Vickson Ferrel

机构 * Faculty of Computer Science & Information Technology(计算机科学与信息科技学院) Universiti Malaysia Sarawak(马来西亚沙巴大学) Vixero Technology Enterprise(Vixero技术企业)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文通过预注册的多智能体LLM模拟,研究了基于同伴怀疑的检测反转问题,发现适应性对手在T_60时的怀疑度低于随机选择的无辜代理,且检测信号在适应性对手行为下解耦。

Comments 14 pages, 6 figures. Pre-registration document and full deviation log included in artifact

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07214 2026-05-11 cs.AI 88%

HMACE: Heterogeneous Multi-Agent Collaborative Evolution for Combinatorial Optimization

HMACE:异构多智能体协作进化用于组合优化

Yuping Yan, Jirui Han, Fei Ming, Yuanshuai Li, Yaochu Jin

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出HMACE框架,通过异构多智能体协作解决组合优化问题,通过策略探索、可执行启发式合成、经验评估和记忆更新四个智能体实现高效启发式搜索,提升搜索质量和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06864 2026-05-11 cs.LG 88%

Multi-Objective Multi-Agent Bandits: From Learning Efficiency to Fairness Optimization

多目标多智能体老虎机:从学习效率到公平性优化

John Wang, Mengfan Xu

机构 * University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文研究了在随机奖励下的多目标多智能体老虎机问题,提出基于Pareto regret的高效学习算法和基于社会福利的公平学习方法,证明了算法在效率和公平性上的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06671 2026-05-11 cs.AI cs.MA 88%

GraphDC: A Divide-and-Conquer Multi-Agent System for Scalable Graph Algorithm Reasoning

GraphDC: 一种用于可扩展图算法推理的分而治之多智能体系统

Wenjin Li, Jiaming Cui

机构 * Department of Computer Science, Virginia Tech(弗吉尼亚理工大学计算机科学系)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 GraphDC通过分而治之的多智能体框架提升图算法推理效率,通过分解图并分配子任务给专用智能体,结合主智能体整合结果,提升大规模图处理的性能和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23947 2026-05-11 cs.AI 88%

GamED.AI: A Hierarchical Multi-Agent Framework for Automated Educational Game Generation

GamED.AI:一种用于自动教育游戏生成的分层多智能体框架

Shiven Agarwal, Yash Shah, Ashish Raj Shekhar, Priyanuj Bordoloi, Vivek Gupta

机构 * Arizona State University(亚利桑那州立大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出GamEDAI框架,通过分层多智能体方法将教师提供的问题转化为可玩的教育游戏,验证通过形式化机制合同。系统在200个问题上实现90%验证通过率和98.3%的模式合规性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07835 2026-05-11 cs.RO cs.MA 88%

Many-to-Many Multi-Agent Pickup and Delivery

多对多多智能体取货与送货

Ethan Schneider, Jingkai Chen, Tianyi Gu, Kunlei Lian, Seth Hutchinson, Sonia Chernova

机构 * Institute of Robotics and Intelligent Machines, Georgia Institute of Technology(机器人与智能机械研究所,佐治亚理工学院) Symbotic Inc.(Symbotic公司) Northeastern University(东北大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出M2M算法解决多对多多智能体取货与送货问题,通过任务持续时间优化和SKU分布优化,提升仓库效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02146 2026-05-11 cs.MA 88%

Distributed Task Allocation for Multi-Agent Systems: A Submodular Optimization Approach

多智能体系统中的分布式任务分配:一种子模优化方法

Jing Liu, Fangfei Li, Xin Jin, Yang Tang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出一种子模优化方法,用于解决资源受限多智能体系统中动态任务分配问题,通过q-独立系统实现更灵活的异构资源限制建模,DGBA算法在保证子模最大化近似保证的同时,降低了计算复杂度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07240 2026-05-11 cs.MA 88%

Rethinking Priority Scheduling for Sequential Multi-Agent Decision Making in Stackelberg Games

重新思考序列多智能体决策中的Stackelberg博弈优先级调度

Xiangyu Liu, Liang Zhang, Bo Jin, Ziqi Wei

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文研究了Stackelberg博弈中多智能体决策顺序对均衡点的影响,提出Hierarchical Priority Adjustment方法,通过上层策略动态选择决策顺序并结合下层STMG策略实现协调学习,实验表明其在高精度控制任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07101 2026-05-11 cs.MA stat.ML 88%

Decentralized Diffusion Policy Learning for Enhanced Exploration in Cooperative Multi-agent Reinforcement Learning

去中心化扩散策略学习用于增强合作多智能体强化学习中的探索

Yuyang Zhang, Haldun Balim, Na Li

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出去中心化扩散策略学习方法,通过扩散概率模型提升多智能体强化学习中的探索能力,解决了高维动作空间下的策略表达限制问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06988 2026-05-11 cs.MA cs.IT cs.RO math.IT 88%

The Cost of Consensus: Malignant Epistemic Herding and Adaptive Gating in Distributed Multi-Agent Search

共识的成本:恶意认知从众与自适应门控在分布式多智能体搜索中的问题

David Farr, Iain Cruickshank, Kate Starbird, Jevin West

机构 * Information School, University of Washington(华盛顿大学信息学院) Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学系) Human Centered Design Engineering, University of Washington(华盛顿大学人本设计工程系)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 研究探讨了在分布式多智能体搜索中,通信频率和内容如何共同影响集体信念状态,提出认知对齐的概念,分析了通信设计对集体推理的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00548 2026-05-11 cs.MA 88%

Neural Power-Optimal Magnetorquer Solution for Multi-Agent Formation and Attitude Control

神经电力最优磁力矩器解决方案用于多智能体编队与姿态控制

Yuta Takahashi, Shin-ichiro Sakai

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出基于学习的电流计算模型,用于实现多智能体编队与姿态控制的电力最优磁场交互,通过顺序凸优化和多层感知机模型实现连续且最优的电流解决方案。

Comments IEEE Robotics and Automation Letters. Preprint Version. Accepted April, 2026 (DOI: https://doi.org/10.1109/LRA.2026.3692064)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02204 2026-05-11 eess.SP 85%

When Eavesdroppers Reason: Agentic Eavesdropping Attacks on Semantic Communication

当窃听者进行推理:语义通信中的代理窃听攻击

Shunpu Tang, Qianqian Yang, Zhiguo Shi, Jiming Chen, Xuemin Shen

专题命中 多智能体 :agentic(title,abstract);agent(abstract);workflow(abstract)

AI总结 本文提出一种基于大语言模型的代理窃听者,通过闭环工作流中的三个功能代理,无需窃听信道状态信息即可实现超过75%的窃听成功率,揭示了语义通信中严重的隐私威胁。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01178 2026-05-11 math.OC q-fin.MF 83%

Modeling Stochastic Multi-Agent Interaction in Intraday Battery Energy Storage Dispatch with Market Power

在日内电池储能调度中建模随机多智能体交互与市场力量

Ruimeng Hu, Mike Ludkovski, Hezhong Zhang

专题命中 多智能体 :agent(title);multi-agent(title)

AI总结 本文提出一个随机博弈模型,研究电网级电池储能系统在日内调度中的交互与市场力量,通过 Riccati 方程分析 Nash 均衡及市场影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07935 2026-05-11 cs.AI cs.MA 83%

TraceFix: Repairing Agent Coordination Protocols with TLA+ Counterexamples

TraceFix:基于TLA+反例的智能体协调协议修复

Shuren Xia, Qiwei Li, Taqiya Ehsan, Jorge Ortiz

机构 * Rutgers University(新泽西州普林斯顿大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 TraceFix通过TLA+反例迭代修复智能体协调协议,实现高效验证与执行,提升任务完成率和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17129 2026-05-11 cs.LG cs.MA cs.RO q-bio.QM 83%

DiffeoMorph: Learning to Morph 3D Shapes Using Differentiable Agent-Based Simulations

DiffeoMorph: 通过可微分基于代理的模拟学习3D形状变形

Seong Ho Pahng, Guoye Guan, Benjamin Fefferman, Sahand Hormoz

机构 * Department of Systems Biology, Harvard Medical School(哈佛医学院系统生物学系) Department of Data Science, Dana-Farber Cancer Institute(达纳-法伯癌症研究所数据科学部) Departments of Biomedical Informatics, Harvard Medical School(哈佛医学院生物医学信息学部) Broad Institute of MIT and Harvard(MIT与哈佛大学Broad研究所)

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出DiffeoMorph框架,通过可微分代理模拟学习形态发生协议,使代理群体变形为目标3D形状,采用SE(3)等价图神经网络和基于3DZernike多项式的形状匹配损失实现旋转不变性和反射敏感性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16928 2026-05-11 cs.GT cs.AI cs.MA 77%

Discovering Multiagent Learning Algorithms with Large Language Models

用大型语言模型发现多智能体学习算法

Zun Li, John Schultz, Daniel Hennes, Marc Lanctot

机构 * Google DeepMind(谷歌DeepMind)

专题命中 多智能体 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文利用AlphaEvolve框架自动发现CFR和PSRO算法,提出VAD-CFR和SHOR-PSRO,通过简化核心机制获得更高效的WOP-CFR和PM-PSRO,提升泛化能力。

Comments More experiments and analysis on algorithmic distilliation

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07773 2026-05-11 physics.soc-ph 71%

Is a team only as strong as its weakest link? Quantifying the short-board effect with AI Agents

团队是否仅如其最弱成员一样强大?利用AI代理量化短板效应

Xin Xu, Jiu Zhang, Xiao-Ling Lei, Xiong-Fei Jiang, Long Xiong

专题命中 多智能体 :AI agent(title)

AI总结 研究通过AI代理模拟团队协作,揭示个体能力与团队绩效的关系,发现短板效应在多个弱成员时呈现累积效应,强调团队管理需超越单一弱成员修复。

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20281 2026-05-11 econ.TH 71%

Existence of Equilibrium Mechanisms in Generalized Principal-Agent Problems with Interacting Teams

一般化委托-代理问题中交互团队的均衡机制存在性

Brian Roberson

专题命中 多智能体 :agent(title)

AI总结 研究多代理人在存在战略外溢的环境中同时设计机制时,通过跟踪诚实服从路径上的结果分布和单方面偏离可实现的结果分布,建立均衡存在的通用条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07692 2026-05-11 cs.AI 70%

GASim: A Graph-Accelerated Hybrid Framework for Social Simulation

GASim:一种用于大规模社会模拟的图加速混合框架

Xuan Zhou, Yanhui Sun, Hantao Yao, Allen He, Yongdong Zhang, Wu Liu

机构 * University of Science and Technology of China(中国科学技术大学) BASIS International School(BASIS国际学校)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出GASim框架,通过图优化内存和图消息传递提升大规模社会模拟效率,实现9.94倍速度提升并降低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07301 2026-05-11 cs.AI 70%

SOM: Structured Opponent Modeling for LLM-based Agents via Structural Causal Model

基于结构因果模型的对手建模:通过结构因果模型实现基于大语言模型的智能体

Shiyue Cao, Pei Xu, Likun Yang, Lei Cui, Xiaotang Chen, Kaiqi Huang

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences \& Institute of Automation, Chinese Academy of Sciences Beijing China National Key Laboratory of Cognition Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences Beijing China School of Artificial Intelligence, University of Chinese Academy of Sciences Beijing China Institute of Automation, Chinese Academy of Sciences Beijing China School of Artificial Intelligence, University of Chinese Academy of Sciences \& Institute of Automation, Chinese Academy of Sciences Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences School of Artificial Intelligence, University of Chinese Academy of Sciences Institute of Automation, Chinese Academy of Sciences

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出SOM框架,通过结构因果模型明确分离对手建模与预测,提升多智能体环境中的预测准确性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06825 2026-05-11 cs.AI cs.RO 70%

Randomness is sometimes necessary for coordination

随机有时是协调所必需的

Rohan Patil, Jai Malegaonkar, Henrik I. Christensen

机构 * Department of Computer Science and Engineering(计算机科学与工程系)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出Diamond Attention架构,通过引入随机数实现临时排名,使不同角色在协作中得以区分,从而在不同规模的团队中实现零样本部署,展示了结构化随机在协调任务中的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09682 2026-05-11 eess.SY cs.AI cs.GT cs.MA cs.SY 70%

Dynamic one-time delivery of critical data by small and sparse UAV swarms: a model problem for MARL scaling studies

动态单次关键数据传递由小而稀疏的无人机群实现:用于MARL扩展研究的模型问题

Mika Persson, Jonas Lidman, Jacob Ljungberg, Samuel Sandelius, Adam Andersson

机构 * Swedish Defence Research Agency (FOI)(瑞典国防研究机构(FOI)) Chalmers University of Technology(查尔姆斯理工大学) the University of Gothenburg, Department of Mathematical Sciences(哥德堡大学数学科学系)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文研究了多智能体强化学习在无人机去中心化控制中的应用,用于传递关键数据包。引入了一类确定性游戏用于MARL扩展研究,提出了一种稳健的基线策略,并通过实验展示了两种现成的MARL算法在小规模时表现良好,但扩展性受限。

Comments Accepted to the 2026 IFAC World Congress

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07960 2026-05-11 cs.HC 67%

Exploring a Virtual Pet to Provide Context Notifications in a Tourism Recommender System: a Pilot Study

探索虚拟宠物在旅游推荐系统中提供上下文通知:一项试点研究

Patrícia Alves, Joana Neto, Ana Barreiro, Jorge Lima, Fausto Alves, Henish Balu, Luís Conceição, Goreti Marreiros

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文探讨了利用虚拟宠物作为社交中介在旅游推荐系统中传递上下文感知通知的方法,通过试点研究验证了其在减少通知侵入性和提升用户接受度方面的有效性。

Comments 30 pages, 7 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏