arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-16 至 2026-06-16 共收录 352 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 107 篇

2606.16354 2026-06-16 cs.CV 新提交 50%

GraphBEV++: Multi-Modal Feature Alignment for Autonomous Driving

GraphBEV++: 自动驾驶中的多模态特征对齐

Ziying Song, Caiyan Jia, Lin Liu, Shaoqing Xu, Lei Yang, Yadan Luo

机构 * Beijing Key Laboratory of Traffic Data Mining and Embodied Intelligence, School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院,交通数据挖掘与具身智能北京市重点实验室) School of Artificial Intelligence (School of Software), Yanshan University(燕山大学人工智能学院(软件学院)) University of Macau(澳门大学) Nanyang Technological University(南洋理工大学) The University of Queensland(昆士兰大学)

专题命中 规划决策 :planning(abstract)

AI总结 针对自动驾驶中BEV感知的特征未对齐问题,提出GraphBEV++框架,通过局部对齐(LocalAlign-v2)和全局对齐(GlobalAlign-v2)模块,利用图匹配、可变形偏移和扩散去噪方法,在多种基准上实现最优性能。

Comments 30 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15915 2026-06-16 cs.RO 新提交 50%

Identification of a Physics-Based Electrical Power Consumption Model for the Unitree G1 Humanoid Arm

基于物理的Unitree G1人形机器人手臂电力消耗模型识别

Nestor N. Deniz, Sebastian Vega, Simon Parsons, Fernando Auat Cheein

机构 * Harper Adams University(哈珀亚当斯大学) Lincoln Institute for Agri-Food Technology(林肯农业食品技术研究所) Lincoln Centre for Autonomous Systems(林肯自主系统中心)

专题命中 规划决策 :planning(abstract)

AI总结 提出一种基于物理的线性参数模型,用于预测Unitree G1人形机器人左臂的电力消耗,通过实验数据识别参数,在897条轨迹上达到R²=0.933,并在未见速度轨迹上验证泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15840 2026-06-16 math.OC 新提交 50%

Multi-Stage Stochastic Optimization and Reinforcement Learning Approaches for Dynamic Inspection of Infrastructure Systems

基础设施系统动态检测的多阶段随机优化与强化学习方法

Juan-Alberto Estrada-Garcia, Siqian Shen

专题命中 规划决策 :planning(abstract)

AI总结 针对多车辆路径调度下组件随机故障的动态检测问题,提出多阶段随机混合整数规划模型,并开发SDDiP算法与强化学习框架,在最优性与可扩展性间取得权衡。

Comments 36 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15550 2026-06-16 cs.RO 新提交 50%

Robots as Tokens: Unified Diffusion Transformer for Coordinated Multi-Robot Trajectory Generation

机器人作为令牌:面向协调多机器人轨迹生成的统一扩散Transformer

Ruofei Bai, Jie Chen, Yuxin Cai, Jun Li, Wei-Yun Yau, Lihua Xie

机构 * Nanyang Technological University(南洋理工大学) Agency for Science, Technology and Research(新加坡科技研究局) National University of Singapore(新加坡国立大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出Roken框架,将每个机器人表示为离散令牌,通过扩散Transformer直接生成满足安全和连通性约束的多机器人轨迹,无需迭代后处理。

Comments 23 pages, 13 figures; \textbf{Project page:} \href{https://bairuofei.github.io/roken-project-page/}{\texttt{bairuofei.github.io/roken-project-page}}

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15384 2026-06-16 cs.DB 新提交 50%

CoeusBI: A Comprehensive Interactive Business Intelligence System Powered by LLMs at Baidu [Extended Version]

CoeusBI:百度基于大语言模型的全面交互式商业智能系统 [扩展版]

Jinqing Lian, Chaofan Li, Yingxia Shao, Ming Wang, Yang Dong, Xinyi Liu, Wei Zhang, Chaoxian Gui, Tianqi Wan, Ming Dong

专题命中 规划决策 :agent(abstract)

AI总结 CoeusBI提出双智能体架构与分层模式链接,通过视图生成智能体自动简化JOIN查询、分层检索处理宽模式、动态路由智能体优化多轮对话,在公共和生产数据集上显著提升查询准确率、令牌效率与用户满意度,已部署于百度平台服务数千用户。

Comments Accepted by VLDB 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15255 2026-06-16 cs.RO 新提交 50%

OSDAG: Online Scheduling for Efficient Multi-Robot Collaboration

OSDAG: 面向高效多机器人协作的在线调度

Thanh Nguyen Canh, Thang Tran Viet, Phuc Van Dinh, Xiem HoangVan, Nak Young Chong

机构 * Japan Advanced Institute of Science and Technology(日本北陆先端科学技术大学院大学) University of Engineering and Technology, Vietnam National University(越南国立大学工程技术大学) Hanyang University(汉阳大学)

专题命中 规划决策 :agent(abstract)

AI总结 提出OSDAG框架,结合LLM任务推理与DAG在线调度,通过一次性分解指令为依赖图并实时分配任务,相比对话式方法推理速度提升5-15倍,调度时间缩短38%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14989 2026-06-16 cs.MA 新提交 50%

Hierarchical Generative Agents for Simulating Sequential Human Behavior

用于模拟序列人类行为的层次化生成式智能体

Maria G. Mendoza, Lucas Waldburger, Jin Lee, Shankar Sastry

专题命中 规划决策 :planning(abstract)

AI总结 提出基于认知层次和人格驱动的生成式智能体框架,结合大语言模型和人类疏散数据,模拟灾害中序列决策行为。

Comments 20 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14882 2026-06-16 cs.RO 新提交 50%

DynaHMRC: Decentralized Heterogeneous Multi-Robot Collaboration for Dynamic Tasks with Large Language Models

DynaHMRC: 基于大语言模型的动态任务去中心化异构多机器人协作

Wenhao Yu, Yu'ang Xie, Yifan Duan, Jie Peng, Guanting Ye, Ka-Veng Yuen, Yanyong Zhang, Jianmin Ji

机构 * University of Science and Technology of China (USTC)(中国科学技术大学) University of Macau (UM)(澳门大学)

专题命中 规划决策 :agent(abstract)

AI总结 提出DynaHMRC去中心化框架,每个机器人作为角色感知的LLM智能体,通过四阶段闭环流程(自我描述、任务分配与领导竞标、领导者选举、反思执行)实现动态异构多机器人协作,并构建基准测试验证其高效性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14810 2026-06-16 cs.LO cs.MA 新提交 50%

Obligation-Producing Actions

产生义务的动作

Kalonji Kalala, Iluju Kiringa, Tet Yeap

专题命中 规划决策 :agent(abstract)

AI总结 提出情境演算中处理产生义务动作的框架问题的解决方案,通过简化可达关系并扩展Reiter的基本动作理论,实现了义务的直觉性质。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14794 2026-06-16 cs.RO 新提交 50%

Computing Smooth Geodesics under Two-Sided Curvature Bounds with Applications to Robotics and Image Analysis

计算双侧曲率约束下的光滑测地线及其在机器人和图像分析中的应用

Da Chen, Zhenjiang Li, Jean-Marie Mirebeau, Xuecheng Tai, Jinglin Zhang, Wei Zhang, Laurent D. Cohen

机构 * CEREMADE, University Paris Dauphine, University-PSL, CNRS, UMR 7534(巴黎多芬纳大学CEREMADE实验室,巴黎文理研究大学,法国国家科学研究中心,UMR 7534) Department of Radiation Oncology, Shandong Cancer Hospital and Institute, Shandong First Medical University, Shandong Academy of Medical Sciences(山东省肿瘤医院放射肿瘤科,山东第一医科大学,山东省医学科学院) Department of Mathematics, Centre Borelli, ENS Paris-Saclay, CNRS, University Paris-Saclay(巴黎萨克雷大学数学系,博雷利中心,巴黎萨克雷高等师范学校,法国国家科学研究中心) Norce(挪威研究中心) School of Control Science and Engineering, Shandong University(山东大学控制科学与工程学院)

专题命中 规划决策 :planning(abstract)

AI总结 提出一种基于Hamilton-Jacobi-Bellman偏微分方程框架的曲率有界测地线模型,通过约束曲率上下界实现路径的光滑性和几何控制,并给出离散化求解方案,应用于机器人路径规划和图像曲线结构跟踪。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13981 2026-06-16 q-fin.MF 新提交 50%

An Actuarial Cost and Revenue Model for Helicopter Emergency Medical Services: Estimating Population-Based Coverage and Sustainability Thresholds

直升机紧急医疗服务的精算成本与收入模型:估算基于人群的覆盖率和可持续性阈值

Robert D. Lieberthal, Sabin Ahmed, David M. Hechtman, Lauren R. Indrisano, Douglas R. Amirault, Susan Haas, Varun Saraswathula

专题命中 规划决策 :planning(abstract)

AI总结 提出两阶段精算模型,结合成本框架和收入模型,估算直升机紧急医疗服务(HEMS)的盈亏平衡运输量,发现实际所需运输量高于以往估计,且对劳动成本和报销水平高度敏感。

Comments 1 Figure; Submitted to PLoS One

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01979 2026-06-16 cs.MA math.OC q-fin.CP 版本更新 50%

A Simple Hierarchical Causality Primer

一个简单的层次因果入门

Tim Gebbie

专题命中 规划决策 :agent(abstract)

AI总结 本文提出一个简单的形式化框架,通过因果类、聚合算子和离散事件时间映射,描述复杂系统中行为者如何约束、选择和组织跨层次的智能体行为。

Comments 15 pages, 1 figure; short technical primer with a toy example in an appendix, corrected minor typos, refined the admissible kernel notation, added a rough Appendix B with the start of an outline of an experimental design requirements specification based on feedback from colleagues and readers (thank you for the feedback and comments)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20280 2026-06-16 physics.soc-ph 版本更新 50%

Spatial Activity Opportunity Fairness among Elderly Residents in Nagoya: A Comparative Analysis across Three Wards with Different Rent Levels

名古屋老年居民的空间活动机会公平性:三个不同租金水平区的比较分析

Jianhao Shi, Tomio Miwa

专题命中 规划决策 :planning(abstract)

AI总结 利用GPS移动数据,通过活动空间、机会背景、机会暴露和语义结构四个维度,比较名古屋三个不同租金水平区老年居民的空间活动机会公平性,发现多维度且类别特定的不平等。

Comments Conference paper submitted to HKSTS 2026. 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05608 2026-06-16 cs.RO 版本更新 50%

HiCrowd: Hierarchical Crowd Flow Alignment for Dense Human Environments

HiCrowd:密集人群环境中的分层人群流对齐

Yufei Zhu, Shih-Min Yang, Martin Magnusson, Allan Wang

机构 * Robot Navigation and Perception Lab, AASS Research Center, Örebro University, Sweden(奥雷布罗大学机器人导航与感知实验室,AASS研究中心,瑞典) Miraikan – The National Museum of Emerging Science and Innovation, Japan(日本新兴科学与创新国家博物馆——Miraikan)

专题命中 规划决策 :planning(abstract)

AI总结 提出HiCrowd分层框架,结合强化学习与模型预测控制,通过跟随人群流解决机器人冻结问题,在真实和合成数据集上提升导航效率与安全性。

Comments 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21957 2026-06-16 cs.RO cs.MA 版本更新 50%

RSPECT: Robust and Scalable Planner for Energy-Aware Coordination of UAV-UGV Teams in Aerial Monitoring

RSPECT:空中监控中无人机-无人车团队能量感知协调的鲁棒可扩展规划器

Cahit Ikbal Er, Amin Kashiri, Yasin Yazicioglu

机构 * Department of Electrical and Computer Engineering, Northeastern University(东北大学电气与计算机工程系)

专题命中 规划决策 :planning(abstract)

AI总结 针对无人机与作为移动充电站的无人车在长期空中监控任务中的鲁棒规划问题,提出可扩展启发式算法RSPECT,通过混合整数规划建模并保证规划可行性与鲁棒性。

Comments Accepted to the Journal of Intelligent & Robotic Systems (JINT)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21208 2026-06-16 math.OC 版本更新 50%

Near Optimality of Discrete-Time Approximations for Controlled McKean-Vlasov and Large Interacting Particle Diffusions

受控McKean-Vlasov和大规模相互作用粒子扩散的离散时间近似的近最优性

Somnath Pradhan, Serdar Yuksel

专题命中 规划决策 :agent(abstract)

AI总结 针对受控McKean-Vlasov扩散,通过松弛策略空间的弱紧性证明分段常数策略的近最优性,建立离散时间近似并推广到N粒子交互系统,统一了集中式和分散式控制下的近似框架。

Comments 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 56 篇

2606.14790 2026-06-16 cs.PL cs.AI 新提交 92%

XFlow: An Executable Protocol Programming System for Reliable Multi-Agent Workflows

XFlow: 一个用于可靠多智能体工作流的可执行协议编程系统

Hanqi Li, Jing Peng, Zijian Wang, Lu Chen, Kai Yu

机构 * X-LANCE Lab, School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(X-LANCE实验室,计算机科学学院,上海交通大学,上海,中国) Jiangsu Key Lab of Language Computing, Suzhou, China(江苏省语言计算重点实验室,苏州,中国) Suzhou Laboratory, Suzhou, China(苏州实验室,苏州,中国)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);tool use(abstract);planning(abstract)

AI总结 提出XFlow可执行协议编程系统及其领域特定语言XPF,通过将工作流承诺从提示移至可检查、可执行的协议结构,并利用生命周期管理的符号中介智能体输出,提升多智能体工作流的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16478 2026-06-16 cs.AI 新提交 92%

Tensor-Coord: Algebraic Decomposition of Joint Plan Tensors for Conflict-Free Multi-Agent LLM Planning

Tensor-Coord:用于无冲突多智能体LLM规划的联合计划张量代数分解

Mudit Rastogi

机构 * University of Michigan(密歇根大学)

专题命中 多智能体 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出Tensor-Coord框架,将多智能体联合计划表示为三阶张量,通过CP和Tucker分解识别协调结构,计算协调复杂度并定位冲突,实现无冲突规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14923 2026-06-16 cs.AI cs.CY cs.MA 新提交 92%

Trust Between AI Agents: Measuring Formation, Breakage, and Recovery, with Implications for Governing Multi-Agent Systems

AI智能体之间的信任:衡量形成、破裂与恢复,及其对多智能体系统治理的启示

Yujiao Chen

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 多智能体 :agent(title,abstract);AI agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出基于代价验证的行为信任度量,通过合作生存游戏研究六个前沿模型快照的信任形成、破裂与恢复,发现信任形成可减少验证,恢复慢于形成,且集群失败延长怀疑,建议校准而非最大怀疑作为治理核心。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17990 2026-06-16 cs.AI 版本更新 92%

WorkflowPerturb: Calibrated Stress Tests for Evaluating Multi-Agent Workflow Metrics

WorkflowPerturb:用于评估多智能体工作流度量的校准压力测试

Madhav Kanda, Sharad Agarwal, Rodrigo Fonseca, Alok Gautam Kumbhare, Pedro Las-Casas

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Microsoft(微软公司)

专题命中 多智能体 :agent(title,abstract);workflow(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出WorkflowPerturb基准,通过对黄金工作流施加分级扰动来评估多智能体工作流度量,揭示度量分数校准不良问题,支持变更管理中的严重性感知解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16386 2026-06-16 cs.GT 新提交 91%

Game-Theoretic Multi-Agent Reinforcement Learning for Swarm Trajectory Planning in Low-Altitude Wireless Networks

低空无线网络中基于博弈论的多智能体强化学习群体轨迹规划

Nguyen Duc Minh Quang, Ruoxi Chong, Zhiqiang Wei, Chang Liu, Derrick Wing Kwan Ng

专题命中 多智能体 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract)

AI总结 针对低空无线网络中多无人机在多小区基站下因资源块分配导致的轨迹耦合问题,提出合作随机拥塞博弈模型和CTDE-MAPPO算法,实现通信与任务联合优化。

Comments Submitted to IEEE/CIC ICCC 2026 in Wuhan

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14805 2026-06-16 cs.SE cs.AI 新提交 90%

Knowledge-Based Zero-Replay Debugging of Multi-Agent LLM Traces

基于知识的无重放多智能体LLM轨迹调试

Dong Ho Kang, Hyeonjeong Cha, Daein Weon

机构 * ustechlab.com(ustechlab)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);tool-use(abstract);分类 cs.AI、cs.SE

AI总结 提出一种知识图谱驱动的无重放预测方法,通过结构化事件知识图谱和轻量级预测器,在不执行重放的情况下定位高影响事件,将轨迹定位召回率从0.73提升至0.93。

Comments 21 pages, 1 figure, 6 tables. Submitted to Knowledge-Based Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15931 2026-06-16 cs.MA cs.AI 新提交 90%

DeepRoot: A KG-Coordinated Multi-Agent System for Therapeutic Reasoning over Historical Medical Texts

DeepRoot: 一个基于知识图谱协调的多智能体系统,用于历史医学文本的治疗推理

Zijian Carl Ma, Sean J. Wang, Sijbren Kramer, Li Erran Li

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学) University of Cambridge(剑桥大学) University of Toronto(多伦多大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 提出DeepRoot多智能体系统,通过联合构建和利用验证知识图谱,将接地与推理分离并组合,从历史医学文本中恢复药物-疾病治疗关系,显著优于基线LLM和工具调用LLM。

Journal ref ICML 2026 GenBio; ACM CAIS 2026 Workshop AI Agents for Discovery in the Wild

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16613 2026-06-16 cs.AI 新提交 89%

CoffeeBench: Benchmarking Long-Horizon LLM Agents in Heterogeneous Multi-Agent Economies

CoffeeBench:异构多智能体经济中的长周期LLM智能体基准测试

Issa Sugiura, Daichi Hattori, Kazuo Araragi, Keita Ogawa, Shota Onose, Taro Makino, Teppei Usuki, Takashi Ishida

机构 * Sakana AI KPMG AZSA LLC

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 提出CoffeeBench基准,在90天模拟中评估LLM智能体在异构多智能体经济中的长周期任务表现,发现高性能模型更积极沟通,而Claude Haiku 4.5存在空闲漂移失败模式。

Comments 23 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14710 2026-06-16 cs.DC cs.AI 新提交 89%

Poster: EdgeCitadel -- Hybrid NATS-MQTT Orchestration for Edge Multi-Agent Systems

海报:EdgeCitadel——面向边缘多智能体系统的混合NATS-MQTT编排

Zhonghao Zhan, Yefan Zhang, Hamed Haddadi

机构 * Imperial College London(帝国理工学院伦敦分校) Independent Researcher(独立研究员)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 针对边缘AI智能体协调依赖云传输或中央中继的问题,提出基于NATS 2.10服务器与内置MQTT适配器的混合编排平台EdgeCitadel,实现异构智能体连接、持久化存储、直接委托和被动聚合,并在ARM64、x64和Android设备上验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01131 2026-06-16 cs.MA cs.AI 版本更新 89%

MedCollab: IBIS-Guided Multi-Agent Collaboration with Hierarchical Disease Relation Chains for Clinical Diagnosis

MedCollab:基于IBIS引导的多智能体协作与分层疾病关系链的临床诊断

Yuqi Zhan, Xinyue Wu, Tianyu Lin, Yutong Bao, Xiaoyu Wang, Weihao Cheng, Huangwei Chen, Feiwei Qin, Zhu Zhu

机构 * Princeton University(普林斯顿大学) Springer Heidelberg(斯普林格海德堡) ABC Institute(ABC研究所) Rupert-Karls-University Heidelberg(海德堡鲁珀特-卡尔大学) Hangzhou Dianzi University(杭州电子科技大学) Zhejiang University(浙江大学) Children’s Hospital, Zhejiang University School of Medicine, National Clinical Research Center for Children and Adolescents’ Health and Diseases(浙江大学医学院儿童医院,国家儿童青少年健康与疾病临床研究中心)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 提出MedCollab框架,通过IBIS结构化论证和分层疾病关系链(HDRC)增强多智能体协作,提升临床诊断的准确性、可追溯性和报告质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16307 2026-06-16 cs.AI cs.CL 新提交 88%

State-Grounded Multi-Agent Synthetic Data Generation for Tool-Augmented LLMs

面向工具增强型大语言模型的基于状态的多智能体合成数据生成

Rahul Khedar, Eshita, Sneha Teja Sree Reddy Thondapu, Mayank Malhotra, Arup Das, Jitesh Chandra, Yun-Shiuan Chuang, Chaitanya Kulkarni, Arun Menon, Linsey Pang, Avinash Karn, Mouli V, Prakhar Mehrotra

机构 * PayPal AI

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 提出StateGen平台,通过四角色LLM循环和状态管理器生成多轮、工具接地的高质量训练对话,消除工具调用幻觉,支持层次化多智能体设置。

Comments 9 pages, 5 figures, 6 tables, 1 algorithm

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15419 2026-06-16 cs.CL cs.AI 新提交 88%

Let LLMs Judge Each Other: Multi-Agent Peer-Reviewed Reasoning for Medical Question Answering

让LLMs互相评判:面向医学问答的多智能体同行评审推理

Zaifu Zhan, Shuang Zhou, Rui Zhang

机构 * University of Minnesota(明尼苏达大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 提出多智能体同行评审推理方法,让多个LLM独立生成思维链推理并相互评估,选择最优推理链输出答案,在三个医学问答数据集上优于单模型和多数投票方法。

Comments Accepted by the Journal of the American Medical Informatics Association

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13003 2026-06-16 cs.AI cs.CL cs.MA 新提交 88%

The Illusion of Multi-Agent Advantage

多智能体优势的错觉

Prathyusha Jwalapuram, Hehai Lin, Chuyuan Li, Fangkai Jiao, Sudong Wang, Yifei Ming, Zixuan Ke, Chengwei Qin, Giuseppe Carenini, Shafiq Joty

机构 * Salesforce Research(Salesforce研究院) HKUST (Guangzhou)(香港科技大学(广州)) University of British Columbia(不列颠哥伦比亚大学) Nanyang Technological University(南洋理工大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 通过系统评估,发现自动生成的多智能体系统在性能和成本效率上均不如单智能体基线(如思维链自一致性),揭示了现有评估框架的缺陷和架构膨胀问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06646 2026-06-16 cs.CL cs.AI 新提交 88%

CAF-Gen: A Multi-Agent System for Enriching Argumentation Structures

CAF-Gen: 一种用于丰富论证结构的多智能体系统

Jakub Bąba, Jarosław A. Chudziak

机构 * Faculty of Electronics and Information Technology, Warsaw University of Technology(电子与信息技术学院,华沙技术大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 提出CAF-Gen多智能体框架,通过迭代创建-评审流程将浅层论证结构自动转换为符合Carneades论证框架的丰富模型,克服单次生成的结构不稳定性。

Comments Accepted for publication in the proceedings of ICCCI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏