arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 3072 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 502 篇

2605.13077 2026-08-04 cs.MA cs.AI 版本更新 88%

Counterfactual Reasoning for Causal Responsibility Attribution in Probabilistic Multi-Agent Systems

反事实推理在概率多智能体系统中的因果责任归因

Chunyan Mu, Muhammad Najib

机构 * University of Aberdeen(阿伯丁大学) Heriot-Watt University(赫瑞瓦特大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出基于反事实推理的因果责任归因方法,利用Shapley值确保公平性和一致性,构建了支持责任感知多智能体系统验证与策略推理的框架,并通过纳什均衡计算稳定策略配置。

Comments Accepted at IJCAI 2026. This is the full version containing all proofs

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08630 2026-08-04 cs.LG 版本更新 88%

Credit Assignment and Efficient Exploration based on Influence Scope in Multi-agent Reinforcement Learning

多智能体强化学习中基于影响范围的信用分配与高效探索

Shuai Han, Mehdi Dastani, Shihan Wang

机构 * Utrecht University(乌特勒支大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 针对多智能体强化学习稀疏奖励场景下的信用分配与探索难题,提出ISA算法,通过计算智能体影响范围分配信用并划定探索空间,实验表明其性能优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23792 2026-08-03 cs.NI cs.LG cs.NA math.NA 版本更新 88%

GNN-based Multi-Agent Control of Traffic Shockwaves in Sparse Vehicular Ad-hoc Networks

基于图神经网络的稀疏车载自组织网络中交通激波的多智能体控制

Prachi Nandi, Madhuri Malakar, Sonakshi Satpathy, Pabitra Mohan Khilar

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 研究稀疏车载自组织网络中交通激波问题,提出集成图神经网络的去中心化多智能体强化学习框架,车辆利用本地信息和邻车交互学习协同控制策略,能有效减少交通激波传播,即使低比例车辆联网时也能减少80%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09037 2026-08-03 cs.AI cs.MA 版本更新 88%

A Multi-Agent System for Motor Design Optimization via an FEA-AI Hybrid Approach

基于FEA-AI混合方法的IPMSM设计优化多智能体系统

Jinseong Han, Sunwoong Yang, Namwoo Kang

机构 * Cho Chun Shik Graduate School of Mobility, KAIST(KAIST Cho Chun Shik 移动研究生院) Department of Mechanical Engineering, Hanyang University(汉阳大学机械工程系) Narnia Labs

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出一种端到端自动化IPMSM设计优化框架,通过RAG结构化问题定义与不确定性感知的FEA-AI混合优化流水线,平衡计算成本与预测可靠性,在同等FEA预算下优于纯FEA或纯AI方法。

Comments 37 pages, 31 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22949 2026-08-03 cs.LG cs.MA 版本更新 88%

MARGIN: Runtime Confidence Calibration for Multi-Agent Foundation Model Coordination

MARGIN:多智能体基础模型协调的运行时置信度校准

Joss Armstrong

机构 * Ericsson, Athlone, Ireland(爱立信,Athlone,爱尔兰)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 提出在线校准方法MARGIN,通过任务流学习每个智能体每个置信度带的校准因子,无需模型访问或重训练,在分布漂移下将校准误差降低3-6倍,并显著提升多智能体选择性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02854 2026-08-03 cs.AI 版本更新 88%

M3MAD-Bench: Multi-Dimensional Evaluation of Multi-Agent Debate Across Domains and Modalities

M3MAD-Bench: 多智能体辩论在不同领域和模态中真的有效吗?

Ao Li, Jinghui Zhang, Luyu Li, Yuxiang Duan, Lang Gao, Mingcai Chen, Weijun Qin, Shaopeng Li, Fengxian Ji, Ning Liu, Lizhen Cui, Xiuying Chen, Yuntao Du

机构 * Shandong University(山东大学) MBZUAI Nanjing University of Posts and Telecommunications(南京邮电大学) BOB Cloud(BOB云)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 M3MAD-Bench通过多领域、多模态和多维指标评估多智能体辩论方法的有效性,提供全面的性能-成本分析。

Comments Accepted by ACMMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30555 2026-07-30 cs.AI cs.MA 版本更新 88%

Linguistic Firewall: Geometry as Defense in Multi-Agent Systems Routing

语言防火墙:多智能体系统路由中的几何防御

Dvir Alsheich, Adar Peleg, Ben Hagag, Rom Himelstein, Amit Levi, Avi Mendelson

机构 * Dvir Alsheich Adar Peleg Ben Hagag Rom Himelstein Amit Levi Avi Mendelson

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出ANTAP架构,通过主动能力测试替代间接代理,将性能蒸馏为语义空间中的行为算子,实现非文本代数投影路由,有效防御描述注入和嵌入攻击。

Comments 8 pages (9 more for appendix), 3 figures. Published at the Second Workshop on Agents in the Wild: Safety, Security, and Beyond (AIWILD) at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17480 2026-07-30 cs.AI 版本更新 88%

The Capability Paradox: How Smarter Auditors Make Multi-Agent Systems Less Secure

能力悖论:更聪明的审计员如何使多智能体系统更不安全

Qiqi Liu, Runhan Song, Shilin Ye

机构 * University of Chinese Academy of Sciences(中国科学院大学) Max Planck Institute for Security and Privacy(马克斯·普朗克安全与隐私研究所) Henan Yinzhu Safety Technology Co., Ltd.(河南亿众安全技术有限公司) Harbin Institute of Technology, Faculty of Computing(哈尔滨工业大学计算机学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文研究了多智能体系统中,随着工人能力的提升,系统级攻击成功率反而上升的现象,揭示了语言确定性在攻击传播中的作用,并提出异质性集成验证作为解决方案,以降低攻击成功率。

Comments 28 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05580 2026-07-29 cs.AI 版本更新 88%

AlphaCrafter: Harnessing Multi-Agent Workflows for Cross-Sectional Quantitative Trading

AlphaCrafter:一个跨截面量化交易的全栈多智能体框架

Yishuo Yuan, Jiayi Sheng, Sirui Zeng, Jiaqi Wang, Jiaheng Liu

机构 * Nanjing University(南京大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 AlphaCrafter通过连续适应的因子到执行管道,整合因子发现、制度适应选择和风险约束执行,实现跨截面量化交易的鲁棒性能。

Comments Submitted to AAAI 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11809 2026-07-28 cs.AI 版本更新 88%

Multi-agent DRL-based Lane Change Decision Model for Cooperative Platooning in Mixed Traffic

基于多智能体深度强化学习的车道变换决策模型:用于混合交通中协同规划

Zeyu Mu, Shangtong Zhang, B. Brian Park

机构 * University of Virginia(弗吉尼亚大学) Link Lab(链接实验室) Department of Systems and Information Engineering(系统与信息工程系) Department of Computer Science(计算机科学系)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出基于多智能体深度强化学习的车道变换决策模型,通过整合CNN-QMIX框架提升CAVs在混合交通中的协同编队效率,实验显示其在提升协同编队率方面表现优异。

Comments Under review at IEEE Transactions on Intelligent Transportation Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05789 2026-07-27 cs.MA cs.GT cs.LG 版本更新 88%

The Coordination Gap: Multi-Agent Alternation Metrics for Temporal Fairness in Repeated Games

协调差距:多智能体交替度量在重复游戏中的时间公平性

Nikolaos Al. Papadopoulos, Ismael Tito Freire, Marti Sanchez-Fibla, Konstantinos E. Psannis

机构 * Department of Applied Informatics, University of Macedonia, Egnatia 156, Thessaloniki 54636, Greece(马其顿大学应用信息学院,Egnatia 156,希腊塞萨洛尼基 54636)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文提出Perfect Alternation作为参考协调模式,设计了六种交替度量指标,揭示传统度量在时间结构敏感性上的不足,表明高总体收益可能伴随差的协调性。

Comments 15 pages, 5 figures, 4 tables, 1 supplementary pdf. Submitted to Complexity

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20324 2026-07-22 cs.MA cs.AI 版本更新 88%

When Agents Disagree: The Selection Bottleneck in Multi-Agent LLM Pipelines

当代理人意见不一致:多代理LLM流水线中的选择瓶颈

Artem Maryanskyy, Dmitry Budnikov, Alibek T. Kaliyev

机构 * Uber

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文研究多代理LLM流水线中团队多样性对输出质量的影响,提出选择瓶颈概念,通过数学公式确定多样性帮助或损害的临界点,并通过实验验证选择机制的重要性。

Comments v2: Updated author list to match the published version. Published in Applied Sciences (MDPI) 2026, DOI: 10.3390/app1010000

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21004 2026-07-22 cs.LG 版本更新 88%

Multi-Agent Inverted Transformer for Flight Trajectory Prediction

多智能体倒置变换器用于飞行轨迹预测

Seokbin Yoon, Keumjin Lee

机构 * Department of Air Transport, Transportation, and Logistics, Korea Aerospace University(航空运输与物流系,韩国航空航天大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文提出MAIFormer,一种多智能体倒置变换器,用于预测飞行轨迹,通过双注意力模块提升预测精度与可解释性。

Comments 11 pages, 8 figures, accepted for IEEE Transactions on Intelligent Transportation System

Journal ref IEEE Transactions on Intelligent Transportation Systems, 2026, pp. 1-11

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14119 2026-07-21 cs.CL 版本更新 88%

Semantic Register Compression in Multi-Agent LLM Cascades

多智能体大语言模型级联中的语义寄存器压缩

Manuele Tele Junior Fernandez

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 研究多智能体大语言模型级联中的语义寄存器压缩现象,用三智能体管道量化压缩,通过五个架构变体分析驱动因素,发现压缩在不同领域强度不同且可泛化,提示级回归可解释大部分方差,对高风险领域安全评估有意义。

Comments 16 pages, 2 figures, 4 tables. Revised version with corrected English-prompt experiments and updated cross-domain and prompt-gradient results

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01608 2026-07-21 cs.AI 版本更新 88%

From Multi-Agent to Single-Agent: When Is Skill Distillation Beneficial?

从多智能体到单智能体:技能蒸馏何时有益?

Binyan Xu, Dong Fang, Haitao Li, Kehuan Zhang

机构 * The Chinese University of Hong Kong(香港中文大学) LIGHTSPEED

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 研究探讨了技能蒸馏在多智能体系统到单智能体系统转换中的有效性,提出通过评估指标的拓扑刚性预测技能效用,并引入AdaSkill框架实现自适应蒸馏。

Comments 36 pages, 15 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30072 2026-07-20 cs.AI 版本更新 88%

ACPO: Agent-Chained Policy Optimization for Multi-Agent Reinforcement Learning

ACPO:面向多智能体强化学习的智能体链式策略优化

Daiki E. Matsunaga, Junho Na, Tri Wahyu Guntara, Scott Sanner, Pascal Poupart, Jongmin Lee, Kee-Eung Kim

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出基于联合策略梯度精确分解的智能体链式策略优化(ACPO),通过序列化决策和信念机制实现独立智能体更新构成联合梯度步,在多机器人仓库等任务中优于强基线方法。

Comments Accepted at RLJ/RLC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07636 2026-07-20 cs.CV cs.CL cs.MA 版本更新 88%

Crayotter: Traceable Multi-Agent Workflows for Long-Form Video Editing

Crayotter: 用于长视频编辑的可追踪多智能体工作流

Lecheng Yan, Yichong Zhang, Xiantao Xu, Jianze Lin, Ben Pan, Xiaoyu Zheng, Jiawei Qian, Anqi Wu, Jiahui Geng, Ruizhe Li, Fengyu Cai, Jingcheng Niu, Raymond Li, Wenxi Li, Chenyang Lyu

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 提出Crayotter,一个开源多模态多智能体系统,通过三阶段工作流(材料准备、基于工件的编辑研究、工具驱动的执行)实现长视频编辑的可追踪性和选择性修订,在人类评估中优于基线方法。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06214 2026-07-17 cs.AI 版本更新 88%

A framework for single and multi-agent human-AI curiosity ecosystems

用于单智能体和多智能体人类-人工智能好奇心生态系统的玩具框架

Ilya E. Monosov

机构 * Johns Hopkins University(约翰斯·霍普金斯大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 该论文提出一个玩具框架,将好奇心视为生态系统,探讨单智能体询问策略及相关决策项权重随经验的变化,还扩展到多智能体,追踪多种指标,为研究好奇心生态及设计多智能体发现系统提供概念框架。

Comments fixed abstract in this version

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08583 2026-07-16 cs.CL 版本更新 88%

Source or It Didn't Happen: A Multi-Agent Framework for Citation Hallucination Detection

来源或未发生:一种用于引用伪造检测的多智能体框架

Mingzhe Li, Zhiqiang Lin, Shiqing Ma

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) The Ohio State University(俄亥俄州立大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 本文提出CiteTracer多智能体框架,通过12种分类体系检测引用伪造,利用PDF和BibTeX提取结构化引用,结合缓存查找、URL获取等方法验证,实现97.1%的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09523 2026-07-16 cs.LG cs.MA 版本更新 88%

NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions

事件驱动的时间图网络用于NetForge_RL中的异步多智能体网络防御

Igor Jankowski

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文提出CT-GMARL方法,通过固定步长神经微分方程处理非规则采样警报,解决多智能体强化学习在仿真到现实转换中的瓶颈问题,实验证明其在连续时间POSMDP中的有效性。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24803 2026-07-16 cs.MA cs.AI 版本更新 88%

MASPRM: Multi-Agent System Process Reward Model

MASPRM:多智能体系统过程奖励模型

Milad Yazdani, Mahdi Mostajabdaveh, Zirui Zhou, Ying Xiong

机构 * Department of Electrical and Computer Engineering, University of British Columbia(英属哥伦比亚大学电气与计算机工程系) Huawei Technologies Canada(华为技术加拿大公司)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 MASPRM通过过程奖励模型在多智能体系统推理中提升搜索效率和质量,提高Hit@1和排序质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19593 2026-07-16 cs.AI cs.MA 版本更新 88%

A Survey on Hypergame Theory: Modelling Misaligned Perceptions and Nested Beliefs for Multi-Agent Systems

关于超博弈理论的综述:为多智能体系统建模错位感知与嵌套信念

Vince Trencsenyi, Agnieszka Mensfelt, Kostas Stathis

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文综述了超博弈理论在多智能体系统中的应用,分析了其建模错位感知与嵌套信念的能力及现有研究中的趋势与挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20963 2026-07-15 cs.LG 版本更新 88%

When and Why Does Multi-Agent Debate Fail and Does It Really Underperform?

多智能体辩论何时以及为何失败,它真的表现不佳吗?

Yongqiang Chen, Gang Niu, James Cheng, Bo Han, Masashi Sugiyama

机构 * The Chinese University of Hong Kong(香港中文大学) RIKEN Center for Advanced Intelligence Project(日本理化学研究院高级智能项目中心) Hong Kong Baptist University(香港 Baptist大学) The University of Tokyo(东京大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 研究多智能体辩论(MAD)失败原因及表现,分析竞争型和寻求共识型MAD范式问题,提出协作协议ColMAD,经实验验证其在错误检测等任务上比之前协议高出10个百分点,且优于单智能体方法,凸显协议设计对MAD潜力实现的关键作用。

Comments Preprint, ongoing work

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08878 2026-07-14 cs.CL cs.MA 版本更新 88%

PerspectiveGap: A Benchmark for Multi-Agent Orchestration Prompting

PerspectiveGap: 多智能体编排提示的基准测试

Youran Sun, Xingyu Ren, Kejia Zhang, Xinpeng Liu, Jiaxuan Guo

机构 * University of Maryland(马里兰大学) The Chinese University of Hong Kong(香港中文大学) Stanford University(斯坦福大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 提出PerspectiveGap基准,评估LLM为多智能体系统编写编排提示的能力,实验显示模型平均通过率仅14.9%,表明该能力独特且未被充分评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15207 2026-07-09 cs.LG cs.MA 版本更新 88%

TeamTR: Trust-Region Fine-Tuning for Multi-Agent LLM Coordination

TeamTR: 用于多智能体大语言模型协调的信赖区域微调

Yi Xie, Siao Liu, Falong Fan, Yuanqi Yao, Yue Zhao, Bo Liu

机构 * Department of Electrical \& Computer Engineering, University of Arizona Engineering College, Soochow University INSAIT, Sofia University "St. Kliment Ohridski" Department of Electrical Computer Engineering, Stony Brook University

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文提出TeamTR,通过信赖区域框架在每个组件更新后重采样轨迹并控制每个智能体的发散度,解决多智能体系统中因上下文分布变化导致的性能下降问题,实验表明其在协调回归抑制和组件替换支持方面优于单智能体和序列基线。

Comments 9pages, Accepted at ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06425 2026-07-09 cs.DC cs.AI 版本更新 88%

HiDVFS: Hierarchical Multi-Agent DVFS for Real-Time OpenMP DAG Workloads

HiDVFS:用于实时OpenMP DAG工作负载的分层多智能体DVFS

Mohammad Pivezhandi, Abusayeed Saifullah, Ali Jannesari

机构 * Department of Computer Science Wayne State University(计算机科学系 温尼耶萨大学) Department of Computer Science University of Texas at Dallas(计算机科学系 德克萨斯大学达拉斯分校) Department of Computer Science Iowa State University(计算机科学系 俄克拉荷马州立大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 研究针对多核嵌入式系统中DVFS调度问题,提出HiDVFS分层多智能体DVFS调度器,通过多智能体协作及相关训练方法,兼顾截止期限和热限制,在多平台验证中取得较好的完成时间、加速比及能耗降低效果。

Comments 52 pages, 24 figures, 32 tables (supplement included as appendices). Under review at IEEE TPDS. v2: fairness-corrected GearDVFS baseline with fair-port study, multi-seed same-window re-measurement and full number audit, 12-benchmark BOTS evaluation, real-time evaluation (feasibility gate, conformal shield, mixed-criticality). Data: https://doi.org/10.5281/zenodo.21212162

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00554 2026-07-09 q-fin.TR cs.CL q-fin.CP 版本更新 88%

ContestTrade: A Multi-Agent Trading System Based on Internal Contest Mechanism

ContestTrade:一种基于内部竞争机制的多智能体交易系统

Rui Sun, Li Zhao, Zuoyou Jiang, Bo Yang, Yuxiao Bai, Mengting Chen, Jing Li, Zuo Bai

机构 * Stepfun FinStep

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 针对基于LLM的智能体在金融交易中决策受市场信息影响的问题,提出ContestTrade多智能体交易系统,通过“量化 - 预测 - 分配”竞争机制及两个专业团队协作,在A股回测中取得较好收益和风险调整绩效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13956 2026-07-07 cs.MA cs.AI 版本更新 88%

AOI: Context-Aware Multi-Agent Operations via Dynamic Scheduling and Hierarchical Memory Compression

AOI:通过动态调度和分层内存压缩实现的上下文感知多智能体操作

Zishan Bai, Hanxuan Chen, Jiayi Gu, Wenqian Weng, Enze Ge, Jiacheng Shi, Yichao Zhang, Zhimo Han, Riyang Bao, Xinyuan Song, Jacqueline Pang, Junfeng Hao

机构 * Columbia University(哥伦比亚大学) Hunan University(湖南大学) Central University of Finance and Economics(中央财经大学) Chongqing University(重庆大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) AI Agent Lab, Vokram Group(Vokram集团人工智能代理实验室) College of William and Mary(威廉与玛丽学院) University of Texas(得克萨斯大学) Zhengzhou University of Light Industry(郑州轻工业大学) Emory University(埃默里大学) Department of Nephrology, Affiliated Hospital of Guangdong Medical University(广东医科大学附属医院肾病科)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出AOI框架,通过动态任务调度和分层内存压缩,提升复杂IT基础设施的自主运维能力,实现72.4%的上下文压缩和94.2%的任务成功率。

Comments new revision

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09662 2026-07-07 cs.MA cs.AI cs.HC 版本更新 88%

AgentDynEx: Nudging the Mechanics and Dynamics of Multi-Agent Simulations

AgentDynEx: 调节多智能体模拟的机制与动态

Jenny Ma, Riya Sahni, Karthik Sreedhar, Lydia B. Chilton

机构 * Columbia University(哥伦比亚大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 AgentDynEx通过配置矩阵和nudging技术帮助设置多智能体模拟,平衡机制与动态,提升模拟复杂性与动态表现。

Comments 40 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21523 2026-07-07 cs.LG 版本更新 88%

Explicit Credit Assignment through Local Rewards and Dependence Graphs in Multi-Agent Reinforcement Learning

多智能体强化学习中通过局部奖励和依赖图进行显式信用分配

Bang Giang Le, Viet Cuong Ta

机构 * Human-Machine Interaction Laboratory(人机交互实验室)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 研究多智能体强化学习中促进合作的方法,结合全局奖励和局部奖励优点,利用智能体交互图更细粒度识别贡献,减轻局部奖励合作问题,实验表明该方法灵活且优于传统设置。

详情

展开后加载摘要…

URL PDF HTML 收藏