arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 14777 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 14777 篇

2606.13598 2026-06-12 cs.AI cs.CL cs.LG cs.MA 新提交 89%

Reward Modeling for Multi-Agent Orchestration

多智能体编排的奖励建模

King Yeung Tsang, Zihao Zhao, Vishal Venkataramani, Haizhou Shi, Zixuan Ke, Semih Yavuz, Shafiq Joty, Hao Wang

机构 * Rutgers University(罗杰斯大学) Salesforce AI Research(Salesforce人工智能研究)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出OrchRM框架,通过自监督学习从多智能体执行中间产物构建奖励模型,无需人工标注,实现高效编排器训练和测试时扩展,在多个领域提升性能并降低计算成本。

Comments Preprint; work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12950 2026-06-12 cs.DC 新提交 89%

Maestro: Workload-Aware Cross-Cluster Scheduling for LLM-Based Multi-Agent Systems

Maestro: 面向基于LLM的多智能体系统的工作负载感知跨集群调度

Jinghao Wang, Xiao Zhou, Xiaoyang Sun, Yihui Zhang, Yilong Li, Tianyu Wo, Xu Wang, Chunming Hu, Renyu Yang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract)

AI总结 提出Maestro调度系统,利用智能体语义预测输出长度和内存使用,通过层次化调度(节点级多模型共置、集群级延迟感知路由、全局工作流感知优先级)在严格GPU预算下优化LLM多智能体服务,减少KV缓存HBM占用67.2%,提高高竞争SLO达标率23.6个百分点。

Comments Accepted to the 46th IEEE International Conference on Distributed Computing Systems (ICDCS 2026). 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12614 2026-06-12 cs.RO 新提交 89%

DARRMS -- An Efficient Algorithm for Dynamic Attention Radius in Resource-Constrained Multi-Agent Systems

DARRMS——资源受限多智能体系统中动态注意力半径的高效算法

Benjamin Alcorn, Eman Hammad

机构 * Texas A&M University(德克萨斯A&M大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 提出DARRMS算法,通过优化注意力半径和决策,在资源受限下降低计算需求,提升协调性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09854 2026-06-10 cs.CL cs.AI cs.CY cs.LG 新提交 89%

Can Multi-Agent LLMs Identify Their Peers? Stylometric Fingerprinting in Role-Constrained Political Analysis

多智能体大语言模型能否识别其同类?角色约束政治分析中的笔迹风格指纹识别

Juergen Dietrich

机构 * Democracy Intelligence gGmbH

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究多智能体LLM在政治分析中能否通过笔迹风格识别模型家族,提出SD-CV协议,T5模型在五类归属任务中达到F1=0.991,证明提示级匿名化无法消除模型身份信号。

Comments 24 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24088 2026-06-10 cs.MA 版本更新 89%

CORRECT: COndensed eRror RECognition via knowledge Transfer in multi-agent systems

CORRECT: 多智能体系统中基于知识迁移的浓缩错误识别

Yifan Yu, Moyan Li, Shaoyuan Xu, Jinmiao Fu, Xinhai Hou, Fan Lai, Bryan Wang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);tool use(abstract)

AI总结 提出CORRECT框架,利用在线缓存蒸馏错误模式,实现轻量级、免训练的错误定位,在多智能体系统中提升错误识别效率,并在七个应用上取得最高19.8%的步骤级错误定位提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04896 2026-06-09 cs.MA 89%

Channel Fracture: Three Instances of Cross-Boundary Silent Delivery Reliability Failures in Multi-Agent Systems

通道断裂:多智能体编排系统中计划性跨智能体内存注入的架构盲点

Dexing Liu

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文发现并分析了多智能体编排系统中计划性智能体因硬编码内存隔离导致无法写入目标智能体持久内存的架构故障模式(通道断裂),提出了包含13维验证框架的CADVP v1.1协议及两个设计原则。

Comments 39 pages, 6 figures, v3-pre expanded to three instances of cross-boundary channel fractures: cron memory injection (40,020 total trials), code-level rglob skill nesting, and WebSocket ACK delivery confirmation fallback fracture (DCFF). Includes PIP principal interest protection principles

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07397 2026-06-08 cs.SD 新提交 89%

Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement

Audio-Oscar: 一个用于复杂音频场景生成、编排和优化的多智能体系统

Yifan Duan, Qixiang Xu, Hengtao Wu, Zhanxun Liu, Wenhao Guan, Junxi Liu, Ziyang Ma, Kelu Xu, Xie Chen

机构 * MoE Key Lab of Artificial Intelligence(人工智能混合专家实验室) X-LANCE Lab(X-LANCE实验室) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室) Xiamen University(厦门大学) State Key Laboratory of Complex & Critical Software Environment, China(复杂与关键软件环境国家重点实验室,中国)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 提出Audio-Oscar多智能体框架,通过协调多个专业智能体处理角色建模、语音生成、时间线规划等,实现复杂音频场景的生成与优化,并构建ASG-Bench基准进行评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07200 2026-06-08 cs.MA 新提交 89%

Learning Multi-Agent Communication Protocol: Study on Information Entropy Efficiency in MARL

学习多智能体通信协议:MARL中信息熵效率研究

Xinren Zhang, Zixin Zhong, Jiadong Yu

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract)

AI总结 提出信息熵效率指数(IEI)作为量化通信效率的指标,通过将其纳入训练损失函数,使智能体学习到平衡性能与信息紧凑性的通信协议,实验表明在保持或提升任务性能的同时提高通信效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24481 2026-06-08 cs.AI cs.CL cs.LG 版本更新 89%

Multi-Agent Reasoning with Consistency Verification Improves Uncertainty Calibration in Medical MCQA

基于一致性验证的多智能体推理改进医学多项选择题问答中的不确定性校准

John Ray B. Martinez

机构 * Department of Data Science and Analytics(数据科学与分析系)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出多智能体框架,结合领域专家智能体与两阶段验证及S分数加权融合,在医学MCQA中显著降低校准误差并提升判别能力。

Comments 20 pages, 6 figures. Preprint under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05476 2026-06-05 cs.CR cs.MA 89%

SHIELDS: Automating OS Hardening with Iterative Multi-Agent Remediation

SHIELDS: 通过迭代多智能体修复实现操作系统加固自动化

Andrew Hamara, Dwight Horne, Aldehir Rojas, Timothy Kurniawan, Sophie Lamothe, Vishal Suresh, Nicholas Turoci, Lawrence Wong

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);tool use(abstract)

AI总结 提出SHIELDS多智能体系统,利用大语言模型通过迭代反馈驱动的方式自动修复操作系统安全配置错误,在多种虚拟机配置下成功修复高达73%的扫描发现。

详情

展开后加载摘要…

URL PDF HTML 收藏
1711.03819 2026-06-04 eess.SY cs.MA cs.RO cs.SY 89%

Cooperative control of multi-agent systems to locate source of an odor

多智能体系统协作控制以定位气味源

Abhinav Sinha, Rishemjit Kaur, Ritesh Kumar, Amol P. Bhondekar

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 本文提出分层协作控制方法,通过多智能体系统定位气味源,结合粒子群算法和滑模控制器实现决策与控制层的协同,验证了分层分布式控制的有效性。

Comments 8 pages, initial results on our work

详情

展开后加载摘要…

URL PDF HTML 收藏
1506.05297 2026-06-04 eess.SY cs.SY 89%

Decentralized Abstractions For Multi-Agent Systems Under Coupled Constraints

去中心化抽象用于受耦合约束的多智能体系统

Dimitris Boskos, Dimos V. Dimarogonas

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 本文提出去中心化框架,通过有限或可数转移系统抽象多智能体系统动态,利用反馈律和自由输入满足系统与网络要求,并设计参数实现多过渡与路径规划。

Comments 40 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1605.07761 2026-06-04 eess.SY cs.MA cs.SY 89%

Designing Distributed Fixed-Time Consensus Protocols for Linear Multi-Agent Systems Over Directed Graphs

设计用于有向图上的线性多智能体系统的分布式固定时间一致性协议

Yu Zhao, Yongfang Liu, Guanrong Chen

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 本文提出了一种基于运动规划方法的分布式固定时间一致性算法,解决了线性多智能体系统在有向图上的固定时间一致性问题,并首次实现了该问题的通用解。

详情

展开后加载摘要…

URL PDF HTML 收藏
1403.3434 2026-06-04 eess.SY cs.SY math.OC 89%

A New Event-Driven Cooperative Receding Horizon Controller for Multi-agent Systems in Uncertain Environments

多智能体系统在不确定环境中的一种新型事件驱动协作递推控制器

Yasaman Khazaeni, Christos G. Cassandras

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 本文提出一种事件驱动的协作递推控制器,用于解决多智能体在不确定环境中最大化收集奖励的问题,通过减少可行控制集维度提升性能。

Comments One results subsection added. Some typos corrected

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30392 2026-06-03 cs.MA cs.GT math.DS 89%

Delayed Repression and Emergent Instability in Adaptive Multi-Agent Systems

自适应多智能体系统中的延迟抑制与涌现不稳定性

Igor Itkin

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract)

AI总结 研究监管延迟如何导致原本稳定的多智能体系统失稳,通过延迟复制方程和强化学习实验揭示了反应性智能体对延迟信号的即时响应是失稳的关键因素。

Comments 32 pages, 13 figures, 2 appendices. v2: corrected network parameterization; central result re-anchored on reactive agents; added robustness sweeps; bibliography fixes; structural and language edits. Code: https://github.com/YehudaItkin/delayed-repression-instability

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02304 2026-06-03 cs.MA cs.AI cs.CL cs.FL cs.LG 89%

Automata-Conditioned Cooperative Multi-Agent Reinforcement Learning

自动机条件化协作多智能体强化学习

Beyazit Yalcinkaya, Marcell Vazquez-Chanlatte, Ameesh Shah, Hanna Krasowski, Sanjit A. Seshia

机构 * Massachusetts Institute of Technology(麻省理工学院) Stanford University(斯坦福大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出自动机条件化协作多智能体强化学习框架,通过自动机分解团队目标为子任务,学习任务条件化的分散策略,实现最优任务分配和多步协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
1104.5384 2026-06-03 eess.SY cs.MA cs.SY math.OC 89%

Chance-constrained Model Predictive Control for Multi-Agent Systems

多智能体系统的机会约束模型预测控制

Daniel Lyons, Jan-P. Calliess, Uwe D. Hanebeck

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 针对多智能体系统的随机模型预测控制问题,提出一种基于概率边界的保守约束方法,在保证实时性的同时避免智能体间碰撞,并通过仿真验证其优于样本近似方法。

Comments 33 pages, 5 figures, revised version

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00939 2026-06-02 cs.MA 89%

FinCom: A Financial Multi-Agent Demo with Disagree-or-Commit Deliberation

FinCom: 一个具有“异议或承诺”审议机制的金融多智能体演示

Chao Peter Yang, Zixiao Tan, Kaisen Yao, Ziyu Zhou, Eleanor Jiang, Michael Wu

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract)

AI总结 针对金融多智能体系统中存在的谄媚问题,提出基于“异议或承诺”协议的FinCom框架,通过结构化异议提升推理准确性和风险意识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00714 2026-06-02 cs.DC 89%

The Cartan-Topos Protocol: A Unified Geometric and Categorical Framework for Resilient Multi-Agent Coordination

Cartan-Topos协议:弹性多智能体协调的统一几何与范畴框架

Manuel Hernández, Eduardo Sánchez-Soto

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 针对连续欧几里得共识在非完整约束下失效、离散符号逻辑在开放世界假设下崩溃的问题,提出一种统一几何与范畴框架,通过黎曼质心流、克利福德代数表示、细胞层和Cartan连接实现弹性多智能体协调,并利用层论规划进行弹性时间推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00308 2026-06-02 cs.SE cs.AI cs.LG 89%

How Generation Architecture Shapes Code Complexity in Multi-Agent LLM Systems: A Paired Study on HumanEval

生成架构如何塑造多智能体LLM系统中的代码复杂度:基于HumanEval的配对研究

Nazmus Ashrafi

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 通过配对实验比较六种多智能体架构在HumanEval上的代码复杂度,发现架构复杂度与功能正确性无正相关,最简架构在准确率上持平或超越复杂架构。

Comments 16 pages, 7 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29744 2026-05-29 cs.AI cs.CL cs.LG cs.MA 89%

Why Specialist Models Still Matter: A Heterogeneous Multi-Agent Paradigm for Medical Artificial Intelligence

为什么专家模型仍然重要:面向医学人工智能的异构多智能体范式

Yanan Wang, Shuaicong Hu, Jian Liu, Guohui Zhou, Aiguo Wang, Cuiwei Yang

机构 * Fudan University(复旦大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出HetMedAgent异构多智能体框架,通过冲突感知证据融合、不确定性驱动的临床医生干预触发和自适应阈值校准,实现通用大语言模型与领域专家模型的协同,在三个临床决策任务中验证了专家模型在模态特定分析中的不可替代价值。

Comments Accepted at ICML 2026. 12 pages main text, 16 pages appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29178 2026-05-29 cs.CR cs.MA 89%

The Best-Laid SCHEMEs: Coordinated Sabotage and Monitoring in Multi-Agent Systems

最佳布局的SCHEMEs:多智能体系统中的协调破坏与监控

Nikolay Radev, Lennart Haas, Benjamin Arnav, Pablo Bernabeu-Pérez

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract)

AI总结 提出SCHEME基准测试,评估多智能体系统在合法任务中协调执行隐藏恶意目标的能力,发现协调破坏已实际可行,但代码编辑可被高精度检测。

Comments 33 pages, 25 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27685 2026-05-28 cs.MA cs.HC 89%

Decoupled Intelligence: A Multi-Agent LLM Framework for Controllable Traffic Scenario Generation in SUMO

解耦智能:用于SUMO中可控交通场景生成的多智能体LLM框架

Shuyang Li, Ruimin Ke

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 提出一种多智能体协作框架,通过解耦仿真流程为规划器、构建器、需求、运行器和分析器等专业角色,并由状态持久化编排器协调,实现SUMO中端到端交通仿真的自动化与可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25357 2026-05-26 cs.CV cs.MA 89%

Towards Reliable Fetal Ultrasound Interpretation with Multi-Agent Collaboration

面向可靠胎儿超声解读的多智能体协作

Xiaotian Hu, Mingxuan Liu, Junwei Huang, Kasidit Anmahapong, Yifei Chen, Yiming Huang, Xuguang Bai, Zihan Li, Hongjia Yang, Yingqi Hao, Hong Xu, Yu Jiang, Tian Tian, Yi Liao, Haibo Qu, Qiyuan Tian

机构 * Tsinghua University(清华大学) University of California San Diego(加州大学圣地亚哥分校) West China Second University Hospital, Sichuan University(四川大学西昌医学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract)

AI总结 提出FetUSAgents多智能体系统,通过协作LLM代理和双路径证据仲裁(DPEA)整合视觉工具与临床推理,在胎儿超声VQA、报告生成等任务上超越最强基线25%以上。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23273 2026-05-25 cs.MA 89%

Self-Refining Topology Optimization via an LLM-Based Multi-Agent Framework

基于LLM多智能体框架的自优化拓扑优化

Hyunjee Park, Hayoung Chung

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract)

AI总结 提出TopOptAgents多智能体系统,通过LLM协作与迭代自优化循环,自动化拓扑优化的决策与设计过程,尤其对文献覆盖不足的问题类效果显著。

Comments 28 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22144 2026-05-22 cs.CV 89%

One Sentence, One Drama: Personalized Short-Form Drama Generation via Multi-Agent Systems

一句话,一出戏剧:通过多智能体系统实现个性化短剧生成

Yufei Shi, Weilong Yan, Naixuan Huang, Yucheng Chen, Chenyu Zhang, Tao He, Si Yong Yeo, Ming Li

机构 * MedVisAI Lab, Lee Kong Chian School of Medicine, Nanyang Technological University(MedVisAI实验室,李光前医学院,南洋理工大学) National University of Singapore(新加坡国立大学) Beijing Institute of Technology(北京理工大学) Tsinghua University(清华大学) University of Electronic Science and Technology of China(电子科技大学) Guangming Laboratory(光明实验室)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 本文提出了一种多智能体框架,通过结构化中间模块和迭代优化,将用户的单句想法转化为完整短剧,解决了短剧生成中的叙事节奏、空间一致性及生产质量控制问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04753 2026-05-22 eess.SY cs.SY 89%

Toward Self-Organizing Production Logistics: A Multi-Agent Approach

迈向自组织生产物流:一种多智能体方法

Jan-Felix Klein, Yongkuk Jeong, Erik Flores-García, Magnus Wiktorsson

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 本文提出自组织生产物流(SOPL)的概念,通过设计科学研究方法论(DSRM)框架,结合多智能体架构、事件驱动协调和数字孪生等技术,解决生产物流中日益复杂的不确定性问题。

Comments Submitted to IFIP International Conference on Advances in Production Management Systems 2026 (APMS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20929 2026-05-21 cs.RO 89%

STEAM: A Training-Free Congestion-Aware Enhancement Framework for Decentralized Multi-Agent Path Finding

STEAM: 一种无需训练的拥堵感知增强框架用于去中心化多智能体路径寻找

Mingyang Feng, Mengnuo Zhang, Shaoyuan Li, Xiang Yin

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(自动化与智能感知学院,上海交通大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出STEAM框架,一种无需训练的去中心化多智能体路径寻找(MAPF)学习方法,在离散环境中通过注入轻量级拥堵感知指导来提升性能,通过空间避让、时间修正和密度修正等方法提高成功率和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14201 2026-05-21 cs.RO cs.CV 89%

MAPLE: Latent Multi-Agent Play for End-to-End Autonomous Driving

MAPLE:基于潜在空间的多智能体交互用于端到端自动驾驶

Rajeev Yasarla, Deepti Hegde, Hsin-Pai Cheng, Shizhong Han, Yunxiao Shi, Meysam Sadeghigooghari, Hanno Ackermann, Litian Liu, Pranav Desai, Fatih Porikli, Mohammad Ghavamzadeh, Hong Cai

机构 * Qualcomm AI Research(英矽人工智能研究)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 本文提出MAPLE框架,通过在视觉-语言-动作模型的潜在空间中实现反应式多智能体滚动,以解决传统模仿学习框架下闭环设置中模型易碎的问题,通过监督微调和强化学习结合多样性奖励,实现了可扩展且无需外部模拟器的闭环训练,提升了端到端自动驾驶系统的鲁棒性。

Comments 19 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01839 2026-05-19 cs.MA 89%

Beyond Static Responses: Multi-Agent LLM Systems as a New Paradigm for Social Science Research

超越静态响应:多智能体LLM系统作为社会科学研究的新范式

Jennifer Haase, Sebastian Pokutta

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract)

AI总结 本文探讨了LLM系统从静态工具向完全智能体系统转变的潜力,提出了一种结构化框架来理解LLM智能体在社会科学研究中的多样化应用,从简单的数据处理器到复杂的多智能体系统,能够模拟涌现的社会动态,并指出在技术边界、方法论和伦理责任方面面临的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏