arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-05-27 至 2026-05-27 共收录 204 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 57 篇

2605.27143 2026-05-27 eess.SY cs.SY 50%

Container Unloading via Reinforcement Learning: Picking Order, Deadlock Avoidance, and Proof-of-Concept Simulation

基于强化学习的集装箱卸载:拣选顺序、死锁避免及概念验证仿真

Jan Rüdiger, Max Schenke, Daniel Weber

专题命中 规划决策 :agent(abstract)

AI总结 针对快递包裹行业集装箱卸载的自动化需求,提出一种基于掩码深度Q学习与特殊神经网络架构的策略,在仿真环境中实现平均60%的成功率,显著优于随机策略的20%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27129 2026-05-27 cs.CV cs.RO 50%

YOLO26-RipeLoc Lite: A lightweight architecture for tomato ripeness detection and picking point localization in greenhouse robotic harvesting

YOLO26-RipeLoc Lite:用于温室机器人采摘中番茄成熟度检测与采摘点定位的轻量级架构

Rajmeet Singh, Manveen Kaur, Shahpour Alirezaee, Irfan Hussain

机构 * Department of Mechanical Engineering(机械工程系) Khalifa University(卡利法大学) University of Windsor(温莎大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出基于YOLO26的轻量级架构YOLO26-RipeLoc Lite,通过轻量特征金字塔网络、成熟度感知注意力模块和紧凑检测头,实现温室番茄的成熟度分类与中心点定位,在仅2.38M参数下达到92.9% mAP@0.5。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27048 2026-05-27 astro-ph.EP 50%

The Physical Nature of Regolith on Icy Moons

冰卫星上风化层的物理性质

Cyril Mergny, Thomas Cornet, Alice Le Gall, Guillaume Cruz-Mermy, Lucas Lange, Tina Rückriemen-Bez, Bastian Gundlach, Paula Heitmann, Moritz Goldmann, Paul O. Hayne, Apurva Oza

专题命中 规划决策 :planning(abstract)

AI总结 通过热惯量测量和模型分析,揭示冰卫星表层风化层具有极高孔隙率(>80%)和细小颗粒(<1 mm),并提出了三种形成机制来解释垂直分层现象。

Comments Submitted to JGR:Planets on May 11, 2026. Please refer to the published version when available

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27002 2026-05-27 astro-ph.EP 50%

The small transiting planet population revealed by ESPRESSO with extreme precision radial velocities

ESPRESSO 极端精度径向速度揭示的小凌星行星种群

M. J. Hobson, B. Lavie, F. Bouchy, C. Lovis, F. Pepe, S. G. Sousa, H. M. Tabernero, S. E. van Terwisga, S. Oe, V. Adibekyan, C. Allende Prieto, Y. Alibert, S. C. C. Barros, A. Castro-González, S. Cristiani, V. D'Odorico, O. D. S. Demangeon, X. Dumusque, D. Ehrenreich, P. Figueira, R. Génova Santos, J. I. González Hernández, J. Lillo-Box, G. Lo Curto, C. J. A. P. Martins, P. Di Marcantonio, A. Mehner, G. Micela, P. Molaro, N. J. Nunes, E. Palle, R. Rebolo, J. Rodrigues, N. Santos, A. Sozzetti, S. Udry, A. Suárez Mascareño, M. -R. Zapatero Osorio

专题命中 规划决策 :planning(abstract)

AI总结 利用 ESPRESSO 光谱仪的超高精度径向速度数据,确认并表征了 K2 和 TESS 任务发现的 30 个系统中的 65 颗小行星,发现了质量阈值、行星质量与恒星金属丰度相关性以及半径谷等种群特征。

Comments 18 pages main text, 8 pages appendices. Accepted for publication in A&A

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26970 2026-05-27 eess.SY cs.SY 50%

Congestion Forecasting for Electric Vehicle Charging Scheduling with Fluid Queues

基于流体队列的电动汽车充电调度拥塞预测

Joas Kahlert, Ruiting Wang, Jonas Mårtensson

专题命中 规划决策 :planning(abstract)

AI总结 提出一种基于流体的拥塞预测方法,用于电动汽车充电调度,在考虑不确定性到达和容量约束下预测充电站可用性,并减少等待时间高达14%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24461 2026-05-27 cs.AR cs.DC cs.SY eess.SY 50%

Provisioning to Runtime Optimization of a 100 MW-Scale AI Cluster

一个100兆瓦级AI集群的供应到运行时优化

Ehsan K. Ardestani, Leonardo Piga, Jovan Stojkovic, Pavan Balaji, Mustafa Ozdal, Mikel Jimenez Fernandez, Mihaela Dimovska, Luka Tadic, Hao Shen, Devika Vishwanath, Richa Mishra, Melaku Mihret, Valentin Andrei, Mauricio Cespedes, Julien Prigent, James Monahan, Tyler Graf, Bin Li, Charles Marquez, Shobhit Kanaujia, Kaushik Veeraraghavan, Chunqiang Tang

专题命中 规划决策 :planning(abstract)

AI总结 本文首次描述了超大规模AI数据中心从早期电力规划到运行时动态功耗管理的端到端过程,并提供了150兆瓦数据中心中83K GB200 GPU集群的详细功耗测量数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24456 2026-05-27 cs.CV 50%

EgoProx: Evaluating MLLMs on Egocentric 3D Proximity Reasoning Across a Cognitive Hierarchy

EgoProx: 在认知层级上评估多模态大语言模型的自我中心3D邻近推理能力

Jinzhao Li, Yinuo Chen, Dongxu Piao, Panwang Pan, Yifan Yu, Dong Wang, Honglei Yan, Liang Yue, Shaofei Wang, Yixin Chen, Siyuan Huang, Miao Liu

机构 * College of AI, Tsinghua University(清华大学人工智能学院) ByteDance(字节跳动) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI)

专题命中 规划决策 :agent(abstract)

AI总结 提出EgoProx基准,通过认知链任务和基于智能体的数据引擎,评估多模态大语言模型在自我中心3D邻近推理中的表现,发现模型虽具备空间知识但难以有效利用。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26637 2026-05-27 cs.RO 50%

Enabling Extensible Embodied Capabilities with Tools

利用工具实现可扩展的具身能力

Xueyang Zhou, Zijia Wang, Qianjiang Li, Yibo Hu, Guiyao Tie, Li Wan, Yidan Liu, Pan Zhou, Lichao Sun, Yongchao Chen

机构 * Huazhong University of Science and Technology(华中科技大学) Hebei University of Technology(河北工业大学) Tianjin University(天津大学) Lehigh University(莱特大学) College of AI, Tsinghua University(清华大学人工智能学院)

专题命中 规划决策 :planning(abstract)

AI总结 提出一种通过外部化能力为工具、并借助标准化协议ETP动态调用工具的方法,在仿真和真实平台上平均提升具身性能31%-36%,但揭示了工具使用在认知和感知方面增益显著而在执行方面有限。

Comments 51 pages, 20 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26544 2026-05-27 quant-ph 50%

Adaptive Shot Allocation for Recursive QAOA via Reinforcement Learning

基于强化学习的递归QAOA自适应测量分配

Euimin Lee, Shiho Kim

专题命中 规划决策 :agent(abstract)

AI总结 针对递归QAOA中测量资源浪费问题,提出基于强化学习的自适应测量分配策略,在加权Max-Cut问题上实现36%的测量数减少且保持成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26437 2026-05-27 econ.GN q-fin.EC 50%

Divergent Minds, Convergent Baselines: A Bounded-Rationality Account of LLM-Human Strategic Behaviour

分歧的思维,趋同的基线:LLM与人类战略行为的有界理性解释

Po Han Teo

专题命中 规划决策 :agent(abstract)

AI总结 本文提出有界理性框架,将人类与LLM在战略博弈中的行为差异归因于计算约束的不同,并给出四个操作测试来区分两者的偏差项δ。

Comments 12 pages, 1 table, no figures. Theoretical prequel paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26406 2026-05-27 cs.NI 50%

mmDiff: A Noise-Robust Differentiable Ray-Tracing Framework for mmWave Scene Calibration and Channel Prediction

mmDiff: 一种用于毫米波场景校准和信道预测的噪声鲁棒可微分光线追踪框架

Haofan Lu, Yadi Cao, Wanghao Yi, Omid Abari

专题命中 规划决策 :planning(abstract)

AI总结 针对重建模型几何噪声导致无线仿真不准确的问题,提出可微分方向散射模型近似镜面反射,实现噪声鲁棒的信道预测与材料校准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26401 2026-05-27 stat.AP stat.ME 50%

Small-Area Precipitation Forecasting and Drought--Flood Early Warning with Reverse-Martingale Regularized Recurrent Networks

基于逆鞅正则化循环网络的小区域降水预报与旱涝预警

Foo Hui-Mean, Yuan-chin Ivan Chang

专题命中 规划决策 :planning(abstract)

AI总结 提出逆鞅正则化循环神经网络(RMRNN)用于概率降水预报和序贯旱涝预警,通过后向一致性惩罚和Shiryaev-Roberts检测器提升预警性能。

Comments 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26392 2026-05-27 math.OC 50%

Integrating Hydrogen into Ontario's Energy Hub: A Robust, Carbon-Aware Framework for Power-Heat-Transport

将氢能整合到安大略省能源枢纽:一种稳健的碳感知电-热-交通协同框架

Hossein Mirzaee, Mostafa Mostafavi Sani, Hamed Samarghandi

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种碳感知且抗不确定性的优化框架,通过混合整数线性规划模型协同优化电力、供暖、制冷和交通能源服务,并显式纳入氢能子枢纽,应用于加拿大安大略省,结果表明氢能大幅扩张且稳健解在保证可行性的同时带来约6.6-9.0%的成本溢价。

Comments 42 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00637 2026-05-27 cs.CR cs.SI 50%

Integrating Network and Attack Graphs for Service-Centric Impact Analysis

集成网络与攻击图的服务中心影响分析

Joni Herttuainen, Vesa Kuikka, Kimmo K. Kaski

专题命中 规划决策 :planning(abstract)

AI总结 提出一种基于概率多层建模的框架,集成攻击图与通信网络拓扑,通过CVSS指标和网络连接概率评估攻击传播可能性及累积影响,并在企业网络案例中验证其识别关键节点、漏洞和服务依赖的能力。

Comments This work has been accepted for publication in IEEE Access. The final published version will be available via IEEE Xplore

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16003 2026-05-27 math.OC cs.SY eess.SY 50%

Time-Optimal Switching Surfaces for Triple Integrator under Full Box Constraints

全箱约束下三积分器的时间最优切换曲面

Yunan Wang, Chuxiong Hu, Zhao Jin

专题命中 规划决策 :planning(abstract)

AI总结 针对全箱约束下的三积分器时间最优控制问题,本文完整刻画了最优切换曲面的几何结构,推导了位置约束的激活条件,并提出一种高效算法,可在非对称约束和任意边界状态下规划时间最优轨迹,计算时间约10微秒,比基于优化的基线方法降低5个数量级。

Comments This paper has been accepted by American Control Conference, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09808 2026-05-27 eess.SY cs.SY 50%

V2Sim: An Open-Source Microscopic V2G Simulation Platform in Urban Power and Transportation Network

V2Sim:城市电力和交通网络中开源微观V2G仿真平台

Tao Qian, Mingyu Fang, Qinran Hu, Chengcheng Shao, Junyi Zheng

专题命中 规划决策 :planning(abstract)

AI总结 提出V2Sim开源仿真平台,通过集成微观城市交通网络与配电网,实现电动汽车充电负荷和动态V2G操作的精确建模,支持自定义V2G策略和并行仿真,以南京实际交通网络案例验证其分析空间-时间分布及评估V2G影响的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 36 篇

2412.20505 2026-05-27 cs.AI cs.CL cs.LG 92%

LiPUP-MA: A Residential Experience-centric Multi-Agent Framework for Living-in-the-loop Participatory Urban Planning

LiPUP-MA:一种以居住体验为中心的循环参与式城市多智能体规划框架

Hang Ni, Yuzhi Wang, Yizhi Song, Hao Liu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The Hong Kong Polytechnic University(香港理工大学)

专题命中 多智能体 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出LiPUP-MA多智能体框架,通过模拟居住生活与体验驱动的计划修订循环,利用基于图的经验库和空间约束技能增强规划器,解决参与式城市规划中经验落地与反馈空间化问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26646 2026-05-27 cs.AI cs.CL cs.MA 91%

UnityMAS-O: A General RL Optimization Framework for LLM-Based Multi-Agent Systems

UnityMAS-O: 基于LLM的多智能体系统的通用强化学习优化框架

Yiqun Chen, Wei Yang, Erhan Zhang, Shijie Wang, Qi Liu, Zechun Niu, Bin Zhang, Haitao Li, Rui Li, Lingyong Yan, Jinyuan Feng, Biqing Qi, Xiaochi Wei, Yan Gao, Yi Wu, Yao Hu, Jiaxin Mao

机构 * Renmin University of China(中国人民大学) Xiaohongshu Inc.(小红书公司)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);agentic(abstract)

AI总结 提出UnityMAS-O框架,将多智能体工作流作为优化单元,通过逻辑角色、图轨迹、用户定义奖励和智能体-模型映射四个核心对象解耦逻辑与物理参数,支持灵活的参数共享和奖励分配,在检索增强问答、迭代搜索和反思代码生成任务上验证了多智能体RL对手动工作流的提升效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24219 2026-05-27 cs.AI 90%

Beyond Final Answers: Auditing Trajectory-Level Hallucinations in Multi-Agent Industrial Workflows

超越最终答案:多智能体工业工作流中的轨迹级幻觉审计

Harshada Badave, Santosh Borse, Andrea Gomez, Harshitha Narahari, Sara Carter, Vishwa Bhatt, Aishani Rachakonda, Shuxin Lin, Dhaval Patel

机构 * IBM Columbia University(哥伦比亚大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract);agentic(abstract)

AI总结 提出Trajel数据集和评估框架,通过五类幻觉分类法审计多智能体工业工作流中的轨迹级幻觉,发现现有基准忽略的常见失败模式,并证明轨迹感知检测优于标准事后验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26289 2026-05-27 cs.LG 90%

Stateful Inference for Low-Latency Multi-Agent Tool Calling

面向低延迟多智能体工具调用的有状态推理

Victor Norgren

机构 * LayerScale, Inc.(LayerScale公司)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);agentic(abstract)

AI总结 提出一种有状态推理架构,通过持久化KV缓存和增量处理,将多智能体工具调用的每轮成本从O(n_t)降至O(Δ_t),在6轮和35轮工作流中分别实现2.1倍和4.2倍的加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07028 2026-05-27 cs.MA cs.AI cs.CL 90%

Strategic Persuasion with Trait-Conditioned Multi-Agent Systems for Iterative Legal Argumentation

基于特质条件的多智能体系统在迭代法律论证中的战略说服

Philipp D. Siedler

机构 * Aleph Alpha Research(Aleph Alpha研究)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 提出战略法庭框架,通过特质条件化的大语言模型智能体模拟多轮法律辩论,发现异质团队表现更优,并引入强化学习特质编排器动态优化辩护策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26521 2026-05-27 cs.SE 89%

Testing Agentic Workflows with Structural Coverage Criteria

使用结构覆盖标准测试智能体工作流

Nafiseh Kahani, Mojtaba Bagherzadeh

专题命中 多智能体 :agentic(title);AI agent(abstract,abstract_cn);agent(abstract);workflow(abstract)

AI总结 针对多智能体工作流的结构化测试问题,提出基于类型化协调图的覆盖驱动测试方法,通过DSPy生成可执行场景,有效检测工具访问、限制和委托路径的结构性回归。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20255 2026-05-27 cs.LG cs.AI cs.HC cs.RO 88%

Multi-Agent Reinforcement Learning for Safe Autonomous Driving Under Pedestrian Behavioral Uncertainty

行人行为不确定性下安全自动驾驶的多智能体强化学习

Prakash Aryan, Kaushik Raghupathruni, Timo Kehrer, Sebastiano Panichella

机构 * University of Bern(伯恩大学) AI4I, The Italian Institute of Artificial Intelligence(意大利人工智能研究所)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文使用多智能体近端策略优化(MAPPO)联合训练自动驾驶汽车和12个行人,通过隐藏的行人特质模拟乱穿马路行为,相比固定策略基线显著降低了碰撞率,并揭示了速度差异指标可用于检测未预期的乱穿马路行为。

Comments Accepted to ICRA 2026 Workshop "8th Workshop on Long-term Human Motion Prediction"

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19420 2026-05-27 cs.CR cs.AI cs.LG cs.MA math.OC 88%

Securing Multi-Agent Systems Against Corruptions via Node Contribution Backpropagation

通过节点贡献反向传播保护多智能体系统免受腐败影响

Chengcan Wu, Zhixin Zhang, Mingqian Xu, Zeming Wei, Meng Sun

机构 * Peking University(北京大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 针对多智能体系统中对抗性智能体注入误导信息的问题,提出一种基于有向无环图的反向传播动态防御方法,通过计算每个智能体对最终决策的贡献来识别和隔离恶意智能体,实验表明该方法优于现有防御机制。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15073 2026-05-27 cs.AI cs.CL 88%

Multi-Agent Causal Discovery Using Large Language Models

多智能体因果发现使用大型语言模型

Hao Duong Le, Xin Xia, Haijie Xu, Chen Zhang

机构 * Department of Industrial Engineering, Tsinghua University(清华大学工业工程系)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 提出多智能体因果发现框架MAC,通过元融合机制结合自主选择SCD算法的辩论编码模块和基于元数据的对抗性辩论模块,在多个基准上取得最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26835 2026-05-27 cs.AI 88%

Helicase: Uncertainty-Guided Supply Chain Knowledge Graph Construction with Autonomous Multi-Agent LLMs

Helicase: 不确定性引导的供应链知识图谱构建与自主多智能体大语言模型

Yunbo Long, Haolang Zhao, Ge Zheng, Alexandra Brintrup

机构 * Department of Engineering, University of Cambridge(剑桥大学工程系) The Alan Turing Institute(艾伦·图灵研究所)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出Helicase,一种基于多智能体大语言模型的自主系统,通过不确定性引导的迭代验证和知识图谱构建,解决供应链中需要多跳推理的结构化推断问题,并引入SCQA基准评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26178 2026-05-27 cs.MA cs.LG 88%

ATOM: Instantiating Budget-Controllable Multi-Agent Collaboration via Nucleus-Electron Hierarchy

ATOM: 通过核-电子层次结构实例化预算可控的多智能体协作

Xinkui Zhao, Sai Liu, Yifan Zhang, Qingyu Ma, Zewen Lin, Naibo Wang, Guanjie Cheng, Chang Liu, Yueshen Xu

机构 * Zhejiang University(浙江大学) Ningbo Global Innovation Center, Zhejiang University(浙江大学宁波全球创新中心) Zhejiang Key Laboratory of Digital-Intelligence Service Technology(浙江省数字智能服务技术重点实验室) Xidian University(西安电子科技大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 提出ATOM框架,采用核-电子层次结构和任务驱动强化学习,生成预算可控的协作图,在保持性能的同时将token效率提升高达30%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21972 2026-05-27 cs.AI cs.DC cs.MA 88%

Learning Decentralized LLM Collaboration with Multi-Agent Actor Critic

基于多智能体Actor-Critic的分散式LLM协作学习

Shuo Liu, Tianle Chen, Ryan Amiri, Christopher Amato

机构 * Northeastern University, Boston, MA(波士顿马萨诸塞大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 针对分散式LLM协作优化,提出两种多智能体Actor-Critic方法(CoLLM-CC和CoLLM-DC),实验表明在长时域或稀疏奖励任务中集中式Critic方法优于蒙特卡洛方法和分散式Critic方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03785 2026-05-27 cs.AI cs.MA 88%

Communication Gain and Delay Cost Under Cross-Timestep Delays in Cooperative Multi-Agent Reinforcement Learning

跨时间步延迟下合作多智能体强化学习中的通信增益与延迟代价

Zihong Gao, Hongjian Liang, Lei Hao, Liangjun Ke

机构 * The State Key Laboratory for Manufacturing Systems Engineering(制造系统工程国家重点实验室) School of Automation Science and Engineering, Xi’an Jiaotong University(西安交通大学自动化科学与工程学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 针对部分可观测环境中跨时间步通信延迟导致的信息错位问题,提出通信增益与延迟代价(CGDC)度量,并基于此设计演员-评论家框架CDCMA,通过预测未来观测和注意力融合延迟消息来提升合作多智能体强化学习的性能、鲁棒性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08586 2026-05-27 cs.AI 88%

DIANOIA: Diagnostic Decomposition and Joint Optimization for Multi-Agent Reasoning

DIANOIA: 多智能体推理的诊断性分解与联合优化

Yiming Yang, Zhuoyuan Li, Fanxiang Zeng, Hao Fu, Yue Liu

机构 * Alibaba Group(阿里巴巴集团)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出DIANOIA框架,通过覆盖度、保真度和综合度三个可测量通道分解多智能体推理增益,并基于此设计诊断协议和对应系统,在多个基准上以更少token实现更优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏