arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 14741 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 14741 篇

2608.00747 2026-08-05 cs.RO cs.AI cs.CR cs.MA 版本更新 89%

When Prompts Control Robots: Prompt Injection Attacks in Multi-Agent Robotic Systems

当提示控制机器人时:多智能体机器人系统中的提示注入攻击

Neha Nagaraja, Amisha Bagari, Hayretdin Bahsi

机构 * School of Informatics, Computing, and Cyber Systems, Northern Arizona University(北亚利桑那大学信息学、计算与网络安全学院) Department of Software Science, Tallinn University of Technology(塔林理工大学软件科学系)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 本文针对基于LLM的多智能体机器人系统,系统研究了直接和间接提示注入攻击的风险、传播特性及架构对攻击成功率的影响,是该领域的首项系统性研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06435 2026-08-04 cs.AI 版本更新 89%

Trust but Verify:Evidence-Linked Multi-Agent Clinical Information Extraction in Pathology

从细则中发现幽门螺杆菌:基于证据关联的多智能体胃活检报告病例发现

Yufan Wang, Anit Kumar Sahu, Yan Fei Ng, Daniel Kang, Shayan Vassef, Soorya Ram Shimgekar, Koustuv Saha, Piyum Zonooz, Navin Kumar, Chee Leong Cheng, Li Yan Khor

机构 * Department of Anatomical Pathology, Singapore General Hospital(新加坡中央医院解剖病理科) Duke–NUS Medical School(新加坡国立大学Duke-NUS医学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Independent Researcher(独立研究者)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 研究针对胃活检报告中幽门螺杆菌证据提取难题,采用Nimblemind多智能体系统,经试点评估其总体准确率达98.61%,虽与其他比较器性能相似,但实现了工作流程整合和可追溯性,还能大幅减少审查时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10475 2026-08-03 cs.AI 版本更新 89%

PEMAND: Persona-Enriched Multi-Agent Negotiation for Household Decision-Making

PEMANT:面向旅行的个性化多智能体谈判

Yuran Sun, Mustafa Sameen, Yaotian Zhang, Rongguan Gu, Mrunal Vibhute, Chia-yu Wu, Yuanyuan Lei, Xilei Zhao

机构 * Department of Civil and Costal Engineering, University of Florida(佛罗里达大学土木与海岸工程系)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 本文提出PEMANT框架,结合行为理论与多智能体谈判,改进家庭旅行决策建模,提升预测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27994 2026-07-31 cs.AI 新提交 89%

SKIMIX: Multi-Agent Harness-Time Scaling with Skill Mixture for Dynamic Harness Engineering

SKIMIX:面向动态 harness 工程的技能混合多智能体 harness 时间缩放方法

Jia Luo

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 SKIMIX 是一种多智能体框架,结合技能检索、抗稀释路由等技术,在六个推理基准上提升开放式数学推理能力,为可扩展智能体设计提供了任务特性相关的实用指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24802 2026-07-31 cs.IR cs.CL 版本更新 89%

SourceMinds at CheckThat! 2026: NLI-Grounded Citation Auditing in a Multi-Agent Pipeline for Full Fact-Checking Article Generation

SourceMinds参与2026年CheckThat!:多智能体管道中基于自然语言推理的引用审核用于完整事实核查文章生成

Farhan Sharukh Hasan, Anirban Saha Anik, Eric Liu, Xiaoying Song, Mohotarema Rashid, Lingzi Hong

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.CL

AI总结 针对CLEF 2026 CheckThat!实验室任务3,提出多智能体管道系统,结合证据检索、结构化规划、文章生成、自我批判及引用审核等方法,强调证据选择、结构化生成与生成后引用验证对事实核查文章生成的重要性。

Comments CLEF 2026 Working Notes / CheckThat! Lab at CLEF 2026, Jena, Germany

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26724 2026-07-30 cs.AI 新提交 89%

UrbanDS: A Graph-Guided LLM Multi-Agent System for Data-Intensive Urban Tasks

UrbanDS:一种用于数据密集型城市任务的图引导大语言模型多智能体系统

Zhilun Zhou, Jianghao Yu, Yuming Lin, yongjun yang, Sun Yongquan, Depeng Jin, Yong Li

机构 * Tsinghua University(清华大学) Jiangmen Municipal Smart Social Governance Technology Innovation Center(江门市智慧社会治理技术创新中心)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本研究针对数据密集型城市任务中现有LLM智能体依赖有限数据集的问题,提出图引导多智能体系统UrbanDS,构建基准UrbanDS-Bench验证其性能,该系统已在武汉东西湖城市平台落地应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25877 2026-07-29 cs.AI 新提交 89%

Runtime Uncertainty Monitoring for LLM-Based Multi-Agent Systems Using Bayesian Networks

基于贝叶斯网络的基于大语言模型的多智能体系统的运行时不确定性监测

Bart Custers, Koorosh Aslansefat

机构 * University of Hull(赫尔大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 研究基于大语言模型的多智能体系统在精算风险建模中的不确定性量化,提出含中央枢纽的多智能体框架,用令牌级对数概率和贝叶斯网络进行不确定性传播,再现基线性能并提供工作流稳定性等见解。

Comments This paper got accepted for Ninth International Workshop on Artificial Intelligence Safety Engineering (WAISE 2026): https://www.waise.org/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25656 2026-07-29 cs.AI 新提交 89%

OrchBench: Evaluating Multi-Agent Orchestration Plans in Isolation via Deterministic Simulation

OrchBench:通过确定性模拟单独评估多智能体编排计划

Zhenzhen Ren, Jiyan He, Xinpeng Zhang, Zhenxing Qian, Ke Han, Shuxin Zheng, GuoBiao Li, Xiaoqing Zhang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 研究多智能体编排计划评估问题,提出OrchBench基准,通过构建有向无环图及确定性模拟单独评估编排计划,模拟分数与Claude Code执行高度相关且资源需求少,为比较和诊断编排计划提供有效基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01862 2026-07-29 cs.MA cs.AI cs.NI 版本更新 89%

RadioMaster: Multi-Agent System for Autonomous Radio Signal Generation

RadioMaster: 自主无线电信号生成的多智能体系统

Jiazhen Lei, Yuxin Sha, Tianze Cao, Sihan Wang, Bingbing Wang, Zeming Yang, Fengyuan Zhu, Xiaohua Tian

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 提出RadioMaster,一个全自主的多智能体框架,通过RadioWiki、RadioAgent和RadioEmulator三大支柱,将用户意图转化为真实无线信号,解决现有模型因领域知识和硬件约束敏感性不足而无法生成无线电信号的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14178 2026-07-28 cs.AI cs.MA 版本更新 89%

ReasFlow: Assisting Reasoning-Centric Scientific Discovery in Applied Mathematics via a Knowledge-Based Multi-Agent System

ReasFlow:通过基于知识的多智能体系统助力应用数学中以推理为中心的科学发现

Yutong He, Daibo Li, Guohong Li, Jiahe Geng, Zhengyang Huang, Can Ren, Zekun Zhang, Yifan Liu, Shuchen Zhu, Hengrui Zhang, Boao Kong, Ming Sun, Shu Li, Chenyi Li, Jiang Hu, Kun Yuan, Zaiwen Wen, Pingwen Zhang

专题命中 多智能体 :agent(title,abstract);multi-agent(title);AI agent(abstract);autonomous agent(abstract)

AI总结 针对理论驱动科学发现探索不足的问题,ReasFlow引入以推理为中心的自主智能体系统,通过内部验证循环和知识检索机制减少专家干预,能统一多项科研任务,从最少提示生成高质量论文,在开源基线中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04779 2026-07-28 cs.AI math.CO 版本更新 89%

Tree-Based Formalization of Multi-Agent Complementarity in Human-AI Interactions

基于树的人机交互中多智能体互补性形式化

Andrea Ferrario

机构 * Institute of Biomedical Ethics and History of Medicine, University of Zurich(伦理与医学史研究所,苏黎世大学) SUPSI, Dalle Molle Institute for Artificial Intelligence (IDSIA)(SUPSI,达勒莫利人工智能研究所) ETH Zurich(苏黎世联邦理工学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出一种基于树的形式化框架,通过有序智能体角色配置和平面二叉树表示人机交互协议,证明互补性在回归中可实现,但在分类中受限于局部聚合和损失函数的自然条件。

Comments 31 pages, 10 figures. Improved notation and added Figure 8 w.r.t. the original submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15781 2026-07-27 cs.AI cs.ET cs.MA 版本更新 89%

AgentFAIR: A Multi-Agent Collaborative Framework for FAIRness Evaluation of Geospatial Datasets

AgentFAIR:用于地理空间数据集公平性评估的多智能体协作框架

Ming Chen, Pranav Pai

机构 * The University of Melbourne(墨尔本大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 研究地理空间数据集公平性评估难题,提出AgentFAIR多智能体框架,结合结构化元数据提取与特定子原则语言模型评估器,给出各项评估结果,支持可审计性与可行性,不过受限于多种因素对准确性和泛化性声明有约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01647 2026-07-27 cs.AI 版本更新 89%

Exploring Robust Multi-Agent Workflows for Environmental Data Management

探索环境数据管理的鲁棒多智能体工作流

Boyuan Guan, Jason Liu, Yanzhao Wu, Kiavash Bahreini

机构 * Florida International University(佛罗里达国际大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出EnviSmart系统,通过知识架构和角色分离的多智能体设计提升环境数据管理的可靠性和效率,验证了多智能体工作流在处理复杂环境数据任务中的优势。

Comments Accepted at PEARC 2026. 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21268 2026-07-24 cs.MA cs.AI econ.GN q-fin.EC 新提交 89%

pAI-Econ-claude: A Gated Human-in-the-Loop Multi-Agent Architecture for AI-Assisted Economic Theory Development

pAI-Econ-claude:用于人工智能辅助经济理论发展的门控人在回路多智能体架构

Chen Zhu, Xiaolu Wang, Weilong Zhang

机构 * China Agricultural University(中国农业大学) University of Cambridge(剑桥大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 研究针对经济学等领域中基于大语言模型智能体输出缺乏正确性信号的可靠性问题,提出pAI-Econ-claude门控人在回路多智能体架构,经实验评估,该架构能提高可审计性,证明不可逆人类判断分配比纯智能体自主性更具信息性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20495 2026-07-24 cs.AI cs.DC cs.MA 新提交 89%

Workload-Aware Caching for Multi-Agent Systems

多智能体系统的工作负载感知缓存

Anas Mohamed, Kaizan Haque, Azal Ahmad Khan, Chetan Sharma, Shuwen Ge, Ali Anwar

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 研究多智能体系统缓存问题,提出结合重新计算成本、DAG 依赖计数和智能体调用频率的工作负载感知逐出策略,经多基准测试评估,该策略能大幅降低延迟,接近无界缓存性能,且与其他优化方法互补。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19899 2026-07-23 cs.MA cs.LG 新提交 89%

Harnessing Disagreement: Detecting Correlated Agreement Blindness in Multi-Agent Triage

利用分歧:检测多智能体分诊中的相关一致性盲点

Shay Seiya McDonnell, Avantika Singh, Quoc-Viet Pham, Vratislav Havlik, Gregory M. P. O'Hare

机构 * School of Computer Science \& Statistics, Trinity College Dublin, College Green, Dublin 2, Ireland ADAPT Centre, Trinity College Dublin, College Green, Dublin 2, Ireland CKDelta, 28/29 Sir John Rogerson's Quay, Dublin 2, Ireland

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.LG

AI总结 研究多智能体分诊中分歧引发升级导致的相关一致性盲点问题,提出结合随机森林、k近邻智能体及校准元模型的ARAT系统。通过实验表明该系统能降低预测不足,跨数据集验证显示多样化产生有效分歧才提升安全,揭示相关故障被忽视的风险。

Comments 14 pages, 2 figures, 3 tables. Accepted at PAAMS 2026; this is the author's pre-review submitted version

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14879 2026-07-23 cs.MA cs.GT cs.LG 版本更新 89%

Temporal Fair Division in Multi-Agent Systems: From Precise Alternation Metrics to Scalable Coordination Proxies

多智能体系统中的时间公平分配:从精确交替度量到可扩展的协调代理

Nikolaos Al. Papadopoulos, Ismael Tito Freire, Marti Sanchez-Fibla, Konstantinos E. Psannis

机构 * University of Macedonia(希腊米科诺斯大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);AI agent(abstract);分类 cs.LG

AI总结 本文提出时间公平分配的新理论,引入旋转周期性度量和滑动窗口度量,通过多智能体战斗实验分析,展示RP和ALT在协调失败检测和计算效率上的互补性。

Comments 26 pages, 6 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18249 2026-07-22 q-bio.QM cs.AI 新提交 89%

MechAInistic: An LLM-guided Multi-Agent System for Reasoning over Genome-Scale Constraint-Based Metabolic Models

MechAInistic:一种由大语言模型引导的多智能体系统,用于基于基因组规模的约束代谢模型进行推理

Josh Loecker, Narayna Puraja, William Bryan, Bhanwar Lal Puniya, Ahmed Abdeen Hamed, Tomáš Helikar

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 研究旨在降低基于约束的代谢建模使用门槛,开发了MechAInistic多智能体系统,借助大语言模型,围绕特定模式将自然语言问题转化为可执行工作流程,通过两个免疫细胞代谢模型用例验证,能生成可追溯的治疗假设。

Comments 23 pages, 6 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18255 2026-07-22 cs.AI 新提交 89%

Semantic Cooperative Games for Contribution Attribution in LLM-Based Multi-Agent Systems

基于大语言模型的多智能体系统中用于贡献归因的语义合作博弈

Pengyi Jiang, Xiaoguang Zhu, Quanyan Zhu

机构 * New York University(纽约大学) University of California, Davis(加利福尼亚大学戴维斯分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 针对基于大语言模型的多智能体系统贡献归因问题,提出语义合作博弈框架,定义语义夏普利值,介绍单轨迹算法SLIC,在特定基准测试中大幅降低计算成本,在多角色工作流程中表现良好,为复杂系统提供快速、无反事实且可解释的归因方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18102 2026-07-22 cs.IR cs.CL cs.MA 版本更新 89%

FinSAgent: Corpus-Aligned Multi-Agent RAG Framework for Evidence-Grounded SEC Filing Question Answering

FinSAgent:用于基于证据的美国证券交易委员会文件问答的语料库对齐多智能体框架

Jijun Chi, Zhenghan Tai, Hanwei Wu, Tung Sum Thomas Kwok, Hailin He, Zixing Liao, Bohuai Xiao, Chaolong Jiang, Jianliang Lei, Jerry Huang, Peng Lu, Muzhi Li, Liheng Ma, Yihong Wu, Sicheng Lyu, Jingrui Tian, Yihan Li, Yanzhang Ma, Sizhe Guan, Dingtao Hu, Yufei Cui, Ling Zhou, Lei Ding, Xinyu Wang

机构 * 1SimpleWay.AI 2McGill University 3University of Toronto 4University of California, Los Angeles 5The Chinese University of Hong Kong 6University of Manitoba 7Universit\'e de Montr\'eal 8Boston University 9Mila - Quebec AI Institute 10CG Matrix Technology Limited 11Lakehead University 12McMaster University

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.CL

AI总结 研究针对美国证券交易委员会文件问答中模型与文件不匹配问题,提出FinSAgent框架,通过角色专用智能体、数据库感知查询分解及多路径检索等方法,提升检索覆盖和答案正确性,在离线和在线实验中均优于基线。

Comments 20 pages, 14 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03698 2026-07-22 cs.LG 版本更新 89%

Multi$^2$: Hierarchical Multi-Agent Decision-Making with LLM-Based Agents in Interactive Environments

Multi$^2$:基于LLM智能体在交互环境中的分层多智能体决策

Sangeun Park, Minhae Kwon

机构 * KAIST(韩国科学技术院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.LG

AI总结 提出Multi$^2$分层多智能体决策框架,通过高层智能体(System 1)使用监督微调生成子目标,低层智能体(System 2)使用离线到在线强化学习执行原子动作,以缓解目标漂移并实现长期稳定控制。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16930 2026-07-21 cs.NI cs.AI eess.SP 新提交 89%

A Multi-Agent System for 5G Throughput Prediction in Multi-Operator Urban Environments

用于多运营商城市环境中5G吞吐量预测的多智能体系统

Muhammad Kabeer, Rosdiadee Nordin, Nadiva Nuriftitah, Sian Lun Lau

机构 * Faculty of Engineering and Technology, Sunway University(Sunway大学工程与技术学院) Department of Computer Science, Federal University Dutsinma(联邦大学杜辛马大学计算机科学系) Future Cities Research Institute (FCRI), Faculty of Engineering and Technology, Sunway University(Sunway大学工程与技术学院未来城市研究所) Future Cities Research Institute (FCRI), Lancaster University(兰卡斯特大学未来城市研究所)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 研究针对多运营商城市环境中5G吞吐量预测问题,提出分层多智能体系统TMAS,将边缘遥测数据动态路由到微智能体。在相关数据集上验证,该系统克服可预测性瓶颈,有高运行效率,为下一代无线网络响应时间提供了有潜力的架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07811 2026-07-20 cs.SE 版本更新 89%

CodeCoR: An LLM-Based Self-Reflective Multi-Agent Framework for Code Generation

CodeCoR:一种基于大语言模型的代码生成自反思多智能体框架

Ruwei Pan, Hongyu Zhang, Chao Liu

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.SE

AI总结 研究针对代码生成中语言模型无法确保代码正确性及多智能体框架工作流性能不稳健的问题,提出CodeCoR框架,通过在不同阶段修剪中间输出减少错误传播,实验证明其优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14097 2026-07-17 cs.AI 新提交 89%

RegNetAgents: A Multi-Agent Framework for Cross-Network Regulatory Driver Identification in Cancer Genomics

RegNetAgents:一种用于癌症基因组学中跨网络调控驱动因子识别的多智能体框架

Jose A. Bird

机构 * Bird AI Solutions(Bird人工智能解决方案公司)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 RegNetAgents是用于癌症基因组学跨网络调控驱动因子识别的多智能体框架,整合不同网络,经双网络分类等操作,对候选因子按证据一致性排名,在乳腺癌和结直肠癌焦点基因中识别出显著富集的调控因子,建立可解释AI框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13558 2026-07-16 cs.AI 新提交 89%

Multi-Agent Collaborative Reasoning with Tool-Augmented Evidence for Urban Region Profiling

基于工具增强证据的多智能体协作推理用于城市区域剖析

Xixuan Hao, Yutian Jiang, Jiabo Liu, Yihang Yang, Guangyin Jin, Song Gao, Yuxuan Liang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) University of Washington(华盛顿大学) Chang’an University(长安大学) University of Wisconsin - Madison(威斯康星大学麦迪逊分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 研究针对城市区域剖析问题,提出UrbanAgent框架,通过多智能体协作推理解决跨模态不一致,将指标预测扩展为闭环过程,经实验验证其性能优于现有基线,在未见城市设置中有强泛化性。

Comments Accepted by KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10002 2026-07-16 cs.AI 版本更新 89%

Interaction Protocol Shapes Moral Judgment in Multi-Agent Debate

辩论动态与价值对齐在大语言模型辩论中

Pratik S. Sachdeva, Tom van Nuenen

机构 * D-Lab University of California, Berkeley(D-Lab 加州大学伯克利分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 研究通过LLM辩论探讨多轮设置中模型的辩论动态与价值对齐,发现不同模型在同步和轮转结构下的行为差异及价值倾向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12339 2026-07-15 cs.HC cs.AI 版本更新 89%

SheetMind: An End-to-End LLM-Powered Multi-Agent Framework for Spreadsheet Automation

SheetMind:一个由端到端大语言模型驱动的用于电子表格自动化的多智能体框架

Xi Cheng, Ruiyan Zhu, Ke Liu, Rakesh Chowdary Machineni, Lyuhao Chen, Brian Zhu, Daniel Jin, Zheng Qi, Neeraj Parihar, Zhoutian Xu, Oliver Gao

机构 * Cornell University(康奈尔大学) University of California, Berkeley(加州大学伯克利分校) University of Michigan(密歇根大学) Carnegie Mellon University(卡内基梅隆大学) Hong Kong University of Science and Technology (GZ)(香港科学与技术大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 介绍由大语言模型驱动的多智能体框架SheetMind用于电子表格自动化,其分层系统含三个智能体,经评估在SheetCopilot基准测试中执行成功率达100%、功能正确性54.8%超对手,消融研究验证配置优势,还集成到谷歌表格。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08403 2026-07-10 cs.AI 新提交 89%

Game Theory Driven Multi-Agent Framework Mitigates Language Model Hallucination

博弈论驱动的多智能体框架减轻语言模型幻觉

Runzhe Liu, Biquan Bie, Zihao Wang, Yuchao Ma, Yexin Liu, Xinghai Li, Harry Yang, Wenbo Yang, Jinzhe Cao, Shengyang Tao

机构 * Dalian University of Technology(大连理工大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 研究针对轻量级大语言模型在科学领域应用受限问题,提出基于博弈论的G-Frame多智能体框架,经结构化推理合成语料库训练出OmniChem模型,性能与GPT 4o mini相当且幻觉大幅减少,为科学领域知识发现提供新途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07695 2026-07-09 cs.AI cs.GT cs.MA 新提交 89%

Institutional Red-Teaming: Deployment Rules, Not Just Models, Causally Shape Multi-Agent AI Safety

机构红队测试:部署规则而非模型,因果性地塑造多智能体人工智能安全

Yujiao Chen

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 研究多智能体人工智能安全中部署规则的影响,提出机构红队测试方法,通过IABench-CA实例化,发现规则改变集体安全、无安全默认规则、身份显著性是机制,还打包成安全案例工作流程认证规则区域并明确风险义务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08068 2026-07-09 cs.LG 新提交 89%

DICE: Entropy-Regularized Equilibrium Selection for Stable Multi-Agent LLM Coordination

DICE: 用于稳定多智能体LLM协调的熵正则化均衡选择

Yi Xie, Zhanke Zhou, Chentao Cao, Bo Liu, Bo Han

机构 * University of Arizona(亚利桑那大学) Hong Kong Baptist University(香港浸会大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.LG

AI总结 提出DICE框架,通过熵正则化均衡选择(HQRE)解决多智能体LLM协调中的不稳定性,实现线性收敛和有限贝叶斯遗憾,在11个基准上平均提升4.3-8.5个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏