arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 14795 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 14795 篇

2510.08529 2026-02-10 cs.CL cs.AI 88%

CoMAS: Co-Evolving Multi-Agent Systems via Interaction Rewards

CoMAS: 通过交互奖励实现协同进化多智能体系统

Xiangyuan Xue, Yifan Zhou, Guibin Zhang, Zaibin Zhang, Yijiang Li, Chen Zhang, Zhenfei Yin, Philip Torr, Wanli Ouyang, Lei Bai

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 CoMAS通过交互奖励实现智能体的自主进化,优于未训练智能体并取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01465 2026-02-10 cs.AI cs.SE 88%

Agyn: A Multi-Agent System for Team-Based Autonomous Software Engineering

Agyn:基于团队的自主软件工程多智能体系统

Nikita Benkovich, Vitalii Valkov

机构 * Mila – Quebec AI Institute (e-Lab)(魁北克AI研究所(e-Lab)) Tel-Aviv, Israel(特拉维夫,以色列)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.SE

AI总结 Agyn提出了一种基于团队结构的多智能体系统,通过模拟工程团队的组织过程和协作方法,实现自主软件工程任务的高效处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06476 2026-02-09 cs.MA cs.AI cs.LG 88%

Prism: Spectral Parameter Sharing for Multi-Agent Reinforcement Learning

Prism:多智能体强化学习中的谱参数共享

Kyungbeom Kim, Seungwon Oh, Kyung-Joong Kim

机构 * Gwangju Institute of Science and Technology (GIST)(光州科学技术学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 Prism通过谱域参数共享机制,在多智能体强化学习中实现智能体间多样性与资源效率的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05183 2026-02-09 cs.LG cs.AI 88%

Data-Centric Interpretability for LLM-based Multi-Agent Reinforcement Learning

面向大语言模型多智能体强化学习的数据导向可解释性

John Yan, Michael Yu, Yuqi Sun, Alexander Duffy, Tyler Marques, Matthew Lyle Olson

机构 * goodstartlabs(Good Start Labs)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出Meta-Autointerp方法,利用SAEs和LLM总结器分析多智能体强化学习行为,发现细粒度行为及奖励黑客,验证SAE特征的有效性并提升智能体性能。

Comments authors 1, 2 and 3 contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06232 2026-02-09 cs.LG cs.AI cs.GT cs.MA 88%

RuleSmith: Multi-Agent LLMs for Automated Game Balancing

RuleSmith:多智能体LLM用于自动化游戏平衡

Ziyao Zeng, Chen Liu, Tianyu Liu, Hao Wang, Xiatao Sun, Fengyu Yang, Xiaofeng Liu, Zhiwen Fan

机构 * Yale University(耶鲁大学) Texas A\&M University(德克萨斯农工大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 RuleSmith利用多智能体LLM实现自动化游戏平衡,通过贝叶斯优化和自适应采样高效搜索参数空间,实现高平衡配置和可解释规则调整。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06038 2026-02-06 cs.RO cs.AI cs.CV cs.LG cs.MA 88%

CommCP: Efficient Multi-Agent Coordination via LLM-Based Communication with Conformal Prediction

CommCP:通过基于大语言模型的通信实现高效的多智能体协调

Xiaopan Zhang, Zejin Wang, Zhixu Li, Jianpeng Yao, Jiachen Li

机构 * Trustworthy Autonomous Systems Laboratory at the University of California, Riverside, CA, USA(加州大学河滨分校可信自主系统实验室)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 CommCP通过基于大语言模型的通信框架,提升多智能体协作任务的成功率和探索效率。

Comments IEEE International Conference on Robotics and Automation (ICRA 2026); Project Website: https://comm-cp.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05289 2026-02-06 cs.CL cs.AI cs.MA 88%

Towards a Science of Collective AI: LLM-based Multi-Agent Systems Need a Transition from Blind Trial-and-Error to Rigorous Science

迈向集体人工智能的科学:基于LLM的多智能体系统需要从盲目试错转向严谨的科学

Jingru Fan, Dewen Liu, Yufan Dang, Huatao Li, Yuheng Wang, Wei Liu, Feiyu Duan, Xuanwen Ding, Shu Yao, Lin Wu, Ruijie Shi, Wai-Shing Leung, Yuan Cheng, Zhongyu Wei, Cheng Yang, Chen Qian, Zhiyuan Liu, Maosong Sun

机构 * Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) Tsinghua University(清华大学) King’s College London(伦敦大学国王学院) Peng Cheng Laboratory(鹏城实验室)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出通过建立协作收益度量(Γ)和因素归因范式,推动多智能体系统从盲目试错向严谨科学转变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04763 2026-02-05 cs.LG cs.AI 88%

Active Asymmetric Multi-Agent Multimodal Learning under Uncertainty

在不确定性下主动非对称多智能体多模态学习

Rui Liu, Pratap Tokekar, Ming Lin

机构 * University of Maryland, College Park(马里兰大学 College Park分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 在不确定性下主动非对称多智能体多模态学习通过模态层面协作提升事故检测性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03794 2026-02-04 cs.AI cs.LG 88%

Understanding Agent Scaling in LLM-Based Multi-Agent Systems via Diversity

通过多样性理解基于大语言模型的多智能体系统中的智能体扩展

Yingxuan Yang, Chengrui Qu, Muning Wen, Laixi Shi, Ying Wen, Weinan Zhang, Adam Wierman, Shangding Gu

机构 * Shanghai Jiao Tong University(上海交通大学) California Institute of Technology(加州理工学院) Johns Hopkins University(约翰霍普金斯大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文通过引入K*指标,揭示了基于大语言模型的多智能体系统中,异质性智能体配置比同质配置更有效,且性能受任务不确定性限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03053 2026-02-04 cs.AI cs.CL cs.MA 88%

MAS-ProVe: Understanding the Process Verification of Multi-Agent Systems

MAS-ProVe: 理解多智能体系统的进程验证

Vishal Venkataramani, Haizhou Shi, Zixuan Ke, Austin Xu, Xiaoxiao He, Yingbo Zhou, Semih Yavuz, Hao Wang, Shafiq Joty

机构 * Rutgers University(罗杰斯大学) Salesforce AI Research(Salesforce人工智能研究)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 MAS-ProVe研究多智能体系统进程验证的有效性,发现LLM作为法官表现优于奖励方法,但验证过程仍面临上下文长度与性能的权衡问题。

Comments Preprint; work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02636 2026-02-04 cs.CL cs.AI cs.IR 88%

WideSeek: Advancing Wide Research via Multi-Agent Scaling

WideSeek: 通过多智能体扩展推进宽研究

Ziyang Huang, Haolin Ren, Xiaowei Yuan, Jiawei Wang, Zhongtao Jiang, Kun Xu, Shizhu He, Jun Zhao, Kang Liu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) University of Science and Technology of China(中国科学技术大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 WideSeek通过多智能体扩展和统一训练框架,提升宽研究的效率与效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02597 2026-02-04 cs.LG cs.AI 88%

ContextEvolve: Multi-Agent Context Compression for Systems Code Optimization

ContextEvolve: 多智能体上下文压缩用于系统代码优化

Hongyuan Su, Yu Zheng, Yong Li

机构 * Tsinghua University, Beijing, China(清华大学) Zhongguancun Academy, Beijing, China(中关村学院) Massachusetts Institute of Technology, Cambridge MA, USA(麻省理工学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 ContextEvolve通过多智能体框架实现系统代码优化,利用上下文压缩提升搜索效率,实验表明其在ADRS基准测试中性能提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02559 2026-02-04 cs.AI cs.CV cs.LG cs.MA 88%

Experience-Driven Multi-Agent Systems Are Training-free Context-aware Earth Observers

基于经验的多智能体系统是无需训练的上下文感知地球观测者

Pengyu Dai, Weihao Xuan, Junjue Wang, Hongruixuan Chen, Jian Song, Yafei Ou, Naoto Yokoya

机构 * The University of Tokyo(东京大学) RIKEN AIP(日本理化学研究所AIP) Hokkaido University(北海道大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 GeoEvolver通过结构化交互使LLM代理无需训练即可获得地球观测专业知识,提升复杂任务的成功率。

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00197 2026-02-04 q-bio.QM cs.AI cs.CL 88%

Rank-and-Reason: Multi-Agent Collaboration Accelerates Zero-Shot Protein Mutation Prediction

Rank-and-Reason: 多智能体协作加速零样本蛋白质突变预测

Yang Tan, Yuanxi Yu, Can Wu, Bozitao Zhong, Mingchen Li, Guisheng Fan, Jiankang Zhu, Yafeng Liang, Nanqing Dong, Liang Hong

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Southern University of Science(南方大学(科学)) East China University of Science and Technology(东中国科学与技术大学)

专题命中 多智能体 :agent(title);multi-agent(title);workflow(abstract);agentic(abstract)

AI总结 Rank-and-Reason通过多智能体协作提升零样本蛋白质突变预测的准确性与效率,显著提高湿实验验证的成功率。

Comments 22 pages, 5 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00017 2026-02-03 cs.CL cs.AI cs.CY cs.MA 88%

SafeTalkCoach: Diversity-Driven Multi-Agent Simulation for Parent-Teen Health Conversations

SafeTalkCoach:基于多样性的多智能体模拟用于父母-青少年健康对话

Benyamin Tabarsi, Wenbo Li, Tahreem Yasir, Aryan Santhosh Kumar, Laura Widman, Dongkuan Xu, Tiffany Barnes

机构 * North Carolina State University(北卡罗来纳州立大学) Florida State University(佛罗里达州立大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 SafeTalkCoach通过多智能体模拟生成多样化的父母-青少年性健康对话,结合真实数据与合成场景,提升对话生成的真实性和可控性,支持AI研究与健康沟通实践。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25550 2026-02-03 cs.AI cs.LG 88%

Unifying Agent Interaction and World Information for Multi-agent Coordination

统一代理交互与世界信息以实现多代理协调

Dongsu Lee, Daehee Lee, Yaru Niu, Honguk Woo, Amy Zhang, Ding Zhao

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Sungkyunkwan University(松云大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出交互-世界潜在空间框架,通过建模通信协议实现多代理协调,提升团队协作效率与鲁棒性。

Comments 2025 NeurIPS ARLET Workshop Oral presentation (https://arlet-workshop.github.io/neurips2025/schedule)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19611 2026-02-03 cs.AI cs.CL 88%

Instructional Agents: Reducing Teaching Faculty Workload through Multi-Agent Instructional Design

教学代理:通过多智能体教学设计减少教学人员的工作量

Huaiyuan Yao, Wanpeng Xu, Justin Turnau, Nadia Kellam, Hua Wei

机构 * Arizona State University(亚利桑那州立大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 教学代理通过多智能体框架自动化生成教学材料,减少教学人员工作量,提升教育普及效率。

Comments Accepted by ECAL'26 main conference; 23 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05005 2026-02-02 cs.LG cs.AI cs.RO 88%

Multi-agent Coordination via Flow Matching

通过流匹配实现多智能体协调

Dongsu Lee, Daehee Lee, Amy Zhang

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Sungkyunkwan University(松均大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 MAC-Flow通过流匹配方法实现多智能体协调,平衡了性能与计算效率,显著提升推理速度的同时保持良好表现。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21919 2026-01-30 cs.AI cs.CL 88%

Self-Compression of Chain-of-Thought via Multi-Agent Reinforcement Learning

通过多智能体强化学习实现链式思维的自我压缩

Yiqun Chen, Jinyuan Feng, Wei Yang, Meizhi Zhong, Zhengliang Shi, Rui Li, Xiaochi Wei, Yan Gao, Yi Wu, Yao Hu, Zhiqiang Pu, Jiaxin Mao

机构 * Renmin University of China(中国人民大学) Xiaohongshu Inc.(小红书公司) Institute of Automation,Chinese Academy of Sciences(中国科学院自动化研究所) University of Southern California(南加州大学) Shandong University(山东大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 通过多智能体强化学习实现链式思维的自我压缩,有效减少响应长度并提升准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21742 2026-01-30 cs.AI cs.CL cs.MA 88%

Epistemic Context Learning: Building Trust the Right Way in LLM-Based Multi-Agent Systems

知识上下文学习:在基于大语言模型的多智能体系统中以正确方式建立信任

Ruiwen Zhou, Maojia Song, Xiaobao Wu, Sitao Cheng, Xunjian Yin, Yuxi Xie, Zhuoqun Hao, Wenyue Hua, Liangming Pan, Soujanya Poria, Min-Yen Kan

机构 * National University of Singapore(国立新加坡大学) Singapore University of Technology(新加坡科技学院) Nanyang Technological University(南洋理工大学) Duke University(杜克大学) University of Waterloo(滑铁卢大学) Microsoft(微软公司) Peking University(北京大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出Epistemic Context Learning(ECL),通过历史交互构建同伴资料以提升多智能体系统中信任建模的准确性,使小型模型在性能上超越大模型,并在多种配置中表现出良好的泛化能力。

Comments Codes and data are available at https://github.com/skyriver-2000/epistemic-context-learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21469 2026-01-30 cs.SE cs.AI 88%

Adaptive Confidence Gating in Multi-Agent Collaboration for Efficient and Optimized Code Generation

多智能体协作中的自适应置信度门控:用于高效优化的代码生成

Haoji Zhang, Yuzhe Li, Zhenqiang Liu, Chenyang Liu, Shenyang Zhang, Yi Zhou

机构 * University of Electronic Science and Technology of China(电子科技大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.SE

AI总结 DebateCoder通过多智能体协作和自适应置信度门控机制,提升小型语言模型在复杂逻辑任务中的代码生成效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19778 2026-01-28 cs.MA cs.AI cs.CY cs.GT cs.SE 88%

Reimagining Peer Review Process Through Multi-Agent Mechanism Design

通过多智能体机制设计重新想象同行评审过程

Ahmad Farooq, Kamran Iqbal

机构 * University of Arkansas at Little Rock(亚拉荷马州立大学拉弗克分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.SE

AI总结 本文提出通过多智能体机制设计解决同行评审失效问题,提出信用经济、优化分配和混合验证等干预措施,旨在实现可持续的同行评审系统。

Comments To appear in the Proceedings of the 2026 IEEE/ACM 48th International Conference on Software Engineering: Future of Software Engineering (ICSE-FoSE). 4 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09342 2026-01-28 cs.CL cs.AI 88%

Improving Implicit Hate Speech Detection via a Community-Driven Multi-Agent Framework

通过社区驱动的多智能体框架改进隐式仇恨言论检测

Ewelina Gajewska, Katarzyna Budzynska, Jarosław A Chudziak

机构 * Warsaw University of Technology(华沙技术大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出一种社区驱动的多智能体框架,通过整合社会文化背景提升隐式仇恨言论检测的准确性和公平性。

Comments This paper has been accepted for the upcoming 18th International Conference on Agents and Artificial Intelligence (ICAART-2026), Marbella, Spain. The final published version will appear in the official conference proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18847 2026-01-28 cs.SE cs.AI 88%

MulVul: Retrieval-augmented Multi-Agent Code Vulnerability Detection via Cross-Model Prompt Evolution

MulVul: 通过跨模型提示进化实现检索增强的多智能体代码漏洞检测

Zihan Wu, Jie Xu, Yun Peng, Chun Yong Chong, Xiaohua Jia

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.SE

AI总结 MulVul通过跨模型提示进化实现多智能体代码漏洞检测,采用由粗到细的策略,利用检索工具提升漏洞识别精度,达到34.79%的Macro-F1成绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18735 2026-01-27 cs.AI cs.LG 88%

Why Keep Your Doubts to Yourself? Trading Visual Uncertainties in Multi-Agent Bandit Systems

为何保留你的怀疑?多智能体老虎机系统中的视觉不确定性交易

Jusheng Zhang, Yijia Fan, Kaitong Cai, Jing Yang, Jiawei Yao, Jian Wang, Guanlong Qu, Ziliang Chen, Keze Wang

机构 * Sun Yat-sen University(中山大学) University of Washington(华盛顿大学) Snap Inc.(Snap公司) Syracuse University(雪城大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 Agora通过去中心化市场交易机制提升多智能体系统在视觉任务中的协调效率与经济性。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18419 2026-01-27 quant-ph cs.AI cs.LG cs.MA 88%

Emergent Cooperation in Quantum Multi-Agent Reinforcement Learning Using Communication

量子多智能体强化学习中通过通信实现的协同涌现

Michael Kölle, Christian Reff, Leo Sünkel, Julian Hager, Gerhard Stenzel, Claudia Linnhoff-Popien

机构 * Munich Quantum Valley(慕尼黑量子谷)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过通信机制在量子多智能体强化学习中实现协同涌现,实验表明MATE等方法能有效提升协作水平。

Comments Accepted at IEEE ICC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18320 2026-01-27 cs.CL cs.AI cs.DB 88%

MultiVis-Agent: A Multi-Agent Framework with Logic Rules for Reliable and Comprehensive Cross-Modal Data Visualization

MultiVis-Agent:一种带有逻辑规则的多智能体框架,用于可靠且全面的跨模态数据可视化

Jinwei Lu, Yuanfeng Song, Chen Zhang, Raymond Chi-Wing Wong

机构 * The Hong Kong Polytechnic University(香港理工大学) The Hong Kong University of Science and Technology(香港科学与技术大学) The Hong Kong University of Science(香港科学大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 MultiVis-Agent通过引入逻辑规则的多智能体框架,提升多模态数据可视化的可靠性与全面性,实现高评分和高完成率。

Comments Accepted to SIGMOD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13481 2026-01-27 cs.AI cs.CL cs.CY 88%

neuralFOMO: Can LLMs Handle Being Second Best? Measuring Envy-Like Preferences in Multi-Agent Settings

neuralFOMO: LLMs能否处理第二好?在多智能体设置中测量类似嫉妒的偏好

Arnav Ramamoorthy, Shrey Dhorajiya, Ojas Pungalia, Rashi Upadhyay, Abhishek Mishra, Abhiram H, Tejasvi Alladi, Sujan Yenuganti, Dhruv Kumar

机构 * BITS Pilani, Pilani Campus(比斯学院,帕利尼校区)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 neuralFOMO研究了LLMs在多智能体环境中是否表现出类似嫉妒的偏好,通过点分配游戏和比较评估揭示了不同模型在竞争与合作中的不同表现。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17152 2026-01-27 cs.CL cs.AI 88%

Dynamic Role Assignment for Multi-Agent Debate

多智能体辩论中的动态角色分配

Miao Zhang, Junsik Kim, Siyuan Xiang, Jian Gao, Cheng Cao

机构 * New York University(纽约大学) Amazon AGI(亚马逊人工智慧)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出动态角色分配框架,通过元辩论选择适合的智能体,提升多代理辩论系统的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17069 2026-01-27 cs.LG cs.AI 88%

Multi-Agent Deep Reinforcement Learning Under Constrained Communications

在受限通信下多智能体深度强化学习

Shahil Shaik, Jonathon M. Smereka, Yue Wang

机构 * US Army CCDC Ground Vehicle Systems Center(美国陆军地面车辆系统中心)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种无需集中信息的分布式多智能体强化学习框架DG-MAPPO,通过多跳通信实现全局状态推断,有效提升了协作任务的鲁棒性和可扩展性。

Comments 21 pages, 8 figures, Under review at ICLR

详情

展开后加载摘要…

URL PDF HTML 收藏