arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 14723 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 14723 篇

2607.17331 2026-07-21 cs.AI cs.MA 新提交 95%

Agentic ERP: Multi-Agent Large Language Model Architecture for Autonomous Enterprise Resource Planning

智能企业资源规划(Agentic ERP):用于自主企业资源规划的多智能体大语言模型架构

Zhihao Liu, Tianyu Wang, Xi Vincent Wang, Lihui Wang

机构 * KTH Royal Institute of Technology(瑞典皇家理工学院) Department of Production Engineering(生产工程系)

专题命中 多智能体 :agentic(title,title_cn);agent(title,abstract);planning(title,abstract);multi-agent(title,abstract)

AI总结 研究针对ERP系统过度依赖人类决策的问题,提出Agentic ERP架构,结合角色对齐的LLM智能体、人工参与框架和图编排器。通过特定决策问题表述、编排解耦及多层面评估,证明该方法优于基线,能让ERP主动执行决策,提供了参考架构与评估协议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02080 2026-06-02 cs.MA cs.AI cs.CV 94%

Agentic-J: An AI Agent for Biological Microscopy Image Analysis

Agentic-J:用于生物显微镜图像分析的AI智能体

Lukas Johanns, Marilin Moor, Davide Panzeri, Yu Zhou, Xinyi Chen, Nora F. K. Pauly, Zixuan Pan, Matthias Gunzer, Andreas Müller, Yiyu Shi, Hedi Peterson, Jianxu Chen

专题命中 多智能体 :agentic(title,title_cn);agent(title,abstract);AI agent(title);workflow(abstract)

AI总结 提出基于容器的多智能体AI助手Agentic-J,通过自然语言接口集成ImageJ/Fiji工具,实现从细胞分割到多条件量化的可追溯、可复现生物图像分析工作流。

Comments Presented at Cell Biology at Scale 2026 (Poster). The Agentic-J project is available at https://mmv-lab.github.io/Agentic-J/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25358 2026-06-25 cs.AI cs.MA 新提交 94%

Agentic Knowledge Tracing: A Multi-Agent LLM Architecture for Stealth Assessment of Financial Literacy in Serious Games

Agentic知识追踪:用于严肃游戏中金融素养隐形评估的多智能体大语言模型架构

Gabriel Santos, Rita Julia, Marcelo Nascimento

机构 * Federal University of Uberlândia Computer Science Faculty(伯南布哥联邦大学计算机科学学院)

专题命中 多智能体 :agentic(title,title_cn);agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 提出多智能体大语言模型架构Agentic BKT,通过四阶段流程从严肃游戏事件中隐形评估金融素养,实验表明其预测效度显著优于单智能体基线。

Comments 8 pages, 5 figures, IEEE CoG 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25233 2026-05-26 cs.AI 94%

Meta-Agent: From Task Descriptions to Verified Multi-Agent Systems

Meta-Agent:从任务描述到经过验证的多智能体系统

Andy Xu, Yu-Wing Tai

机构 * Dartmouth College(达特茅斯学院)

专题命中 多智能体 :agent(title,title_cn);multi-agent(title,abstract);AI agent(abstract);planning(abstract)

AI总结 提出Meta-Agent两阶段框架,通过任务规划、网络搜索、代码生成和验证机制,自动从自然语言任务描述构建并执行可靠的多智能体系统,在编码、上下文学习和开放推理任务中提升成功率、错误恢复和工作流稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14266 2026-05-15 cs.AI cs.CY 94%

Agentic AI Ecosystems in Higher Education: A Perspective on AI Agents to Emerging Inclusive, Agentic Multi-Agent AI Framework for Learning, Teaching and Institutional Intelligence

高等教育中的代理AI生态系统:对AI代理在新兴包容性、代理多代理AI框架中学习、教学和机构智能的视角

Vidya K Sudarshan, Anushka Sisodia, Reshma A Ramachandra, Sia Batra, Josephine Chong Leng Leng

机构 * College of Computing and Data Science, Nanyang Technological University, NTU, Singapore(南洋理工大学计算机与数据科学学院) DeepMed Ptd Ltd, India(印度DeepMed公司)

专题命中 多智能体 :agent(title,abstract);AI agent(title,abstract);agentic(title,abstract);multi-agent(title,abstract)

AI总结 本文探讨高等教育中代理多代理AI平台的整合,旨在解决教育机构复杂性中的碎片化问题,强调包容性和适应性决策的重要性。

Comments 50 pages, 14 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03695 2026-05-26 cs.MA cs.AI cs.CL 94%

Agent Primitives: Reusable Latent Building Blocks for Multi-Agent Systems

Agent Primitives: 面向多智能体系统的可复用潜在构建模块

Haibo Jin, Peng Kuang, Ye Yu, Xiaopeng Yuan, Haohan Wang

机构 * School of Information Sciences, University of Illinois at Urbana-Champaign, IL, USA(伊利诺伊大学厄巴纳-香槟分校信息科学学院) Siebel School of Computing and Data Science, University of Illinois at Urbana-Champaign, IL, USA(伊利诺伊大学厄巴纳-香槟分校Siebel计算与数据科学学院)

专题命中 多智能体 :agent(title,title_cn);multi-agent(title,abstract);planning(abstract,abstract_cn);分类 cs.AI、cs.CL

AI总结 提出Agent Primitives,一组可复用的潜在构建模块,通过KV缓存内部通信和自动组合,提升多智能体系统的鲁棒性、效率和跨任务复用性。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04997 2026-08-14 cs.AI cs.MA 版本更新 93%

Foam-Agent: A Large Language Model-Based Multi-Agent Framework for Automating Computational Fluid Dynamics Workflows

Foam-Agent:迈向自动化智能CFD工作流程

Ling Yue, Nithin Somasekharan, Tingwen Zhang, Yadi Cao, Zhangze Chen, Shimin Di, Shaowu Pan

机构 * Department of Computer Science, Rensselaer Polytechnic Institute(里士满理工学院计算机科学系) Department of Mechanical, Aerospace, and Nuclear Engineering, Rensselaer Polytechnic Institute(里士满理工学院机械、航空航天与核工程系) Department of Computer Science and Engineering, University of California San Diego(加州大学圣地亚哥分校计算机科学与工程系) College of Education, Zhejiang Normal University(浙江师范大学教育学院) School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院)

专题命中 多智能体 :agent(title,title_cn);multi-agent(title,abstract);planning(abstract);workflow(abstract)

AI总结 Foam-Agent通过多智能体框架和大型语言模型,实现自动化CFD工作流程,显著提升模拟效率和成功率。

Comments 34 pages, 9 figures, 9 tables

Journal ref Computer Methods in Applied Mechanics and Engineering, Vol. 461, 119271 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20145 2025-02-11 cs.CL 93%

Efficient Multi-Agent Collaboration with Tool Use for Online Planning in Complex Table Question Answering

Wei Zhou, Mohsen Mesgar, Annemarie Friedrich, Heike Adel

专题命中 多智能体 :agent(title,abstract);tool use(title,abstract);planning(title,abstract);multi-agent(title,abstract)

Comments Accepted at NAACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11514 2026-05-13 cs.CR 93%

FlowSteer: Prompt-Only Workflow Steering Exposes Planning-Time Vulnerabilities in Multi-Agent LLM Systems

FlowSteer:仅凭提示的流程引导揭示多智能体LLM系统的规划时间漏洞

Fanxiao Li, Jiaying Wu, Tingchao Fu, Natasha Jaques, Wei Zhou, Min-Yen Kan

专题命中 多智能体 :agent(title,abstract);planning(title,abstract);workflow(title,abstract);multi-agent(title,abstract)

AI总结 研究通过社会影响探测工作流识别高影响子任务,揭示恶意信号传播漏洞,提出FlowSteer攻击方法提升恶意成功率,并引入FlowGuard防御机制降低攻击效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08274 2026-07-28 cs.MA 版本更新 93%

Toward Human-Centered Multi-Agent Systems: Integrating Cognition, Culture, Values, and Cooperation in AI Agents

迈向以人为中心的多智能体系统:在AI智能体中整合认知、文化、价值观与合作

Safia Baloch, Rahemeen Khan

专题命中 多智能体 :agent(title,abstract);AI agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract)

AI总结 本文综述了从认知科学、文化对齐、价值学习到多智能体协调的研究,指出现有系统缺乏整合认知、文化、价值观和社会行为的统一框架,并提出了构建文化感知、价值对齐、认知基础与合作的多智能体系统的方向。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07306 2026-07-07 cs.RO cs.AI 版本更新 93%

BioProVLA-Agent: An Affordable, Protocol-Driven, Vision-Enhanced VLA-Enabled Embodied Multi-Agent System with Closed-Loop-Capable Reasoning for Biological Laboratory Manipulation

BioProVLA-Agent:一种经济实惠、基于协议、视觉增强的VLA启用的具身多智能体系统,具备闭环推理能力,用于生物实验室操作

Zhaohui Du, Zhe Wang, Dongzhan Zhou, Minting Pan, Hongmei Fei, Xiwen Cao, Ting Xiao, Qi Wang, Huanbo Jin, Jiaming Gu, Quan Lu, Zhe Liu

机构 * Key Laboratory of Smart Manufacturing in Energy Chemical Process Ministry of Education, East China University of Science and Technology, Shanghai, CN(能源化工过程智能制造教育部重点实验室,东华大学,上海,中国) Department of Computer Science and Engineering, East China University of Science and Technology, Shanghai, CN(东华大学计算机科学与工程系,上海,中国) Department of Laboratory Medicine, Ruijin Hospital, Shanghai Jiao Tong University School of Medicine, Shanghai, CN(复旦大学附属瑞金医院检验医学科,上海,中国) School of Information Science and Technology, Shihezi University, Shihezi, CN(石河子大学信息科学与技术学院,石河子,中国)

专题命中 多智能体 :agent(title,title_cn);multi-agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出BioProVLA-Agent,通过协议驱动和视觉增强,实现生物实验室操作中的具身多智能体系统,具备闭环推理能力,提升在湿实验室环境中的执行稳定性。

Comments 17 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17698 2026-05-19 cs.LG cs.MA 93%

Agent Bazaar: Enabling Economic Alignment in Multi-Agent Marketplaces

Agent Bazaar: 使多智能体市场场所具备经济对齐能力

Seth Karten, Cameron Crow, Chi Jin

机构 * Princeton University(普林斯顿大学)

专题命中 多智能体 :agent(title,title_cn);multi-agent(title,abstract);agentic(abstract);分类 cs.LG

AI总结 该研究提出Agent Bazaar框架,用于评估多智能体系统的经济对齐能力,通过分析两种失败模式(算法不稳定和Sybil欺骗)发现模型难以自我调节,并提出经济对齐的训练方法和EAS评分标准。

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11147 2026-01-19 cs.AI 93%

Do We Always Need Query-Level Workflows? Rethinking Agentic Workflow Generation for Multi-Agent Systems

我们是否总是需要查询级工作流?重新思考多智能体系统中的代理工作流生成

Zixu Wang, Bingbing Xu, Yige Yuan, Huawei Shen, Xueqi Cheng

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 多智能体 :agent(title,abstract);workflow(title,abstract);multi-agent(title,abstract);agentic(title)

AI总结 本文提出SCALE框架,通过低成本任务级生成替代查询级生成,减少令牌消耗并保持性能。

Comments 17 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10644 2026-05-26 cs.AI cs.CL cs.CR cs.HC cs.MA 93%

From Multi-Agent Systems and the Semantic Web to Agentic AI: A Unified Narrative of the Web of Agents

从多智能体系统和语义网到智能体AI:智能体网络的统一叙事

Tatiana Petrova, Boris Bliznioukov, Aleksandr Puzikov, Radu State

机构 * SEDAN - SnT University of Luxembourg(卢森堡大学)

专题命中 多智能体 :agent(title,abstract);agentic(title,abstract);multi-agent(title,abstract);AI agent(abstract)

AI总结 本文提出智能体网络(WoA)经历了从平台端协调(第一代)、数据端标注(第二代)到模型端解释(第三代)的语义努力迁移,并分析了各代失败模式及当前开放问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23414 2026-05-25 cs.AI cs.LG 93%

When Planning Fails Despite Correct Execution: On Epistemic Calibration for LLM-Based Multi-Agent Systems

当计划正确执行却失败时:基于LLM的多智能体系统的认知校准

Zehao Wang, Shilong Jin, Zhao Cao, Lanjun Wang

机构 * College of Intelligence and Computing, Tianjin University, Tianjin, China(天津大学智能与计算学院) School of New Media and Communication, Tianjin University, Tianjin, China(天津大学新媒体与传播学院) Gaoling School of Artificial Intelligence, Renmin University of China, Beijing, China(中国人民大学北京校区人工智能学院)

专题命中 多智能体 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract);workflow(abstract)

AI总结 针对基于LLM的多智能体系统中因认知误校准导致计划失败的问题,提出认知计划校准代理工作流(EPC-AW),通过信息一致性计划选择和一致性引导的认知状态细化,平均提升系统成功率9.75%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12307 2026-01-21 cs.MA cs.CL cs.LG 93%

Rethinking the Value of Multi-Agent Workflow: A Strong Single Agent Baseline

重新思考多智能体工作流的价值:一个强大的单智能体基线

Jiawei Xu, Arief Koesdwiady, Sisong Bei, Yan Han, Baixiang Huang, Dakuo Wang, Yutong Chen, Zheshen Wang, Peihao Wang, Pan Li, Ying Ding

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Amazon(亚马逊) Emory University(埃默里大学) Northeastern University(东北大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 多智能体 :agent(title,abstract);workflow(title,abstract);multi-agent(title,abstract);tool use(abstract)

AI总结 本研究通过单个代理的多轮对话模拟多智能体工作流,提出OneFlow算法,实现高效且准确的多代理流程,为多智能体系统研究提供强基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28425 2026-06-30 cs.CR cs.AI 93%

Tool Use Enables Undetectable Steganography in Multi-Agent LLM Systems

工具使用使多智能体LLM系统中的隐写术无法检测

Jimmy Laurence Rippin, Simon C. Marshall, David Demitri Africa, Christian Schroeder de Witt

机构 * Oxford University(牛津大学) Artificial Intelligence Security Institute (AISI)(人工智能安全研究所)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);tool use(title);AI agent(abstract)

AI总结 本文研究多智能体AI系统中通过工具使用(如代码执行、网络搜索)实现无法检测的隐写通信,发现智能体可自适应构建隐写系统,并提出协调度量评估无事先约定的隐写协调风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23626 2026-04-28 cs.CL 93%

GraphPlanner: Graph Memory-Augmented Agentic Routing for Multi-Agent LLMs

GraphPlanner: 多智能体LLM的图记忆增强代理路由

Tao Feng, Haozhen Zhang, Zijie Lei, Peixuan Han, Jiaxuan You

机构 * Department of Computer Science(计算机科学系)

专题命中 多智能体 :agent(title,abstract);agentic(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 GraphPlanner通过图记忆增强代理路由方法,提升多智能体LLM在任务规划和多轮协作中的性能,实现更高的准确率和计算效率。

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04133 2025-12-19 cs.AI 93%

TRiSM for Agentic AI: A Review of Trust, Risk, and Security Management in LLM-based Agentic Multi-Agent Systems

TRiSM 用于代理 AI:对基于 LLM 的代理多代理系统中信任、风险和安全管理的综述

Shaina Raza, Ranjan Sapkota, Manoj Karkee, Christos Emmanouilidis

机构 * Vector Institute, Toronto, Canada(向量研究所) Cornell University, USA(康奈尔大学) University of Groningen, Netherlands(格罗宁根大学)

专题命中 多智能体 :agent(title,abstract);agentic(title,abstract);multi-agent(title,abstract);AI agent(abstract)

AI总结 本文综述了基于 LLM 的代理多代理系统中信任、风险和安全管理的框架与方法,提出新的评估指标并探讨了安全与隐私增强策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29146 2026-06-01 cs.CL cs.AI 93%

SafeRx-Agent: A Knowledge-Grounded Multi-Agent Framework for Safe and Explainable Medication Recommendation

SafeRx-Agent: 基于知识的多智能体框架用于安全且可解释的药物推荐

Xinyu Wang, Hanwei Wu, Zhenghan Tai, Sicheng Lyu, Qincheng Lu, Ziyu Zhao, Jijun Chi, Jingrui Tian, Xiao-Wen Chang, Ziyang Song

机构 * McGill University(麦吉尔大学) McMaster University(麦马斯特大学) University of Toronto(多伦多大学) Ohio University(俄亥俄大学)

专题命中 多智能体 :agent(title,title_cn);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 提出SafeRx-Agent,一种基于知识的多智能体框架,通过患者上下文、外部临床知识和安全验证来推荐可追溯的药物集合,在MIMIC-III和MIMIC-IV数据集上提高了细粒度药物预测准确性,同时控制了药物相互作用、禁忌症和药物集合大小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10938 2026-04-14 cs.MA 93%

AgentWebBench: Benchmarking Multi-Agent Coordination in Agentic Web

AgentWebBench: 多智能体协调在代理网络中的基准测试

Shanshan Zhong, Kate Shen, Chenyan Xiong

专题命中 多智能体 :agent(title,abstract);agentic(title,abstract);multi-agent(title,abstract);autonomous agent(abstract)

AI总结 AgentWebBench评估用户代理与网站特定内容代理交互回答问题的能力,发现多智能体协调在大规模模型下可超越集中检索,但需更高效的规划与证据质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06659 2025-12-09 cs.CR 93%

The Evolution of Agentic AI in Cybersecurity: From Single LLM Reasoners to Multi-Agent Systems and Autonomous Pipelines

代理AI在网络安全中的演变:从单一LLM推理者到多代理系统和自主流水线

Vaishali Vinay

专题命中 多智能体 :agent(title,abstract);agentic(title,abstract);multi-agent(title,abstract);tool use(abstract)

AI总结 本文探讨了网络安全中代理AI从单一LLM到多代理系统的发展,分析了五代分类法及各代在推理深度、工具使用等维度的差异,并总结了当前面临的挑战。

Comments Accepted at ICAIC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13046 2026-08-14 cs.AI cs.CE cs.ET 新提交 92%

BoardroomAI: Dependency-Aware Human-Steerable Multi-Agent Deliberation through Evolving Decision Graphs

BoardroomAI:通过演化决策图实现依赖感知、人类可引导的多Agent审议

Sanjeev Manivannan

机构 * Indian Institute of Technology Madras(马德拉斯印度理工学院)

专题命中 多智能体 :agent(title,title_cn);multi-agent(title,abstract);分类 cs.AI

AI总结 BoardroomAI通过四个组件实现依赖感知的人类可引导多Agent审议,实验显示其传播效率高、修复效果好,为相关研究提出了决策充分上下文闭合的需求。

Comments 14 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09832 2026-06-30 cs.HC cs.AI 新提交 92%

Agentic Social Affordance Framework (ASAF): Agent Identity Design as a Collaboration Interface in Multi-Agent Systems

智能体社会可供性框架 (ASAF):多智能体系统中作为协作接口的智能体身份设计

Meng-Han Lee

机构 * Independent Researcher(独立研究者)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(title,abstract);autonomous agent(abstract)

AI总结 提出ASAF框架,将社会可供性理论扩展到多智能体AI系统,将智能体身份设计视为协作接口,通过身份信号、行为启动和协作治理三个机制影响人机协作质量。

Comments 36 pages, 2 figures, 1 table. Introduces ASAF with falsifiable hypotheses and proposed experimental designs for testing agent identity design effects in multi-agent Human-in-the-Loop systems, grounded in a real-world 38-agent deployment

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20380 2026-05-19 cs.MA cs.AI cs.HC 92%

Herding CATs: ALARA for Agent Harness Engineering in Portable Composable Multi-Agent Teams

Herding CATs: ALARA for Agent Harness Engineering in Portable Composable Multi-Agent Teams

Christopher J. Agostino, Nayan D'Souza

机构 * Celeria, Inc.(Celeria公司) Department of Linguistics, Indiana University(印第安纳大学语言学系)

专题命中 多智能体 :agent(title,title_cn);multi-agent(title,title_cn);agentic(abstract);分类 cs.AI

AI总结 本文提出ALARA原则应用于多智能体团队的代理 harness 工程,通过引入CAT数据层,使用户能够直接声明工具访问权限并修改代理使用的工具,从而提升智能体在各种任务中的表现。

Comments Accepted to HAXD 2026, 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17353 2026-04-21 cs.AI cs.DC 92%

Hive: A Multi-Agent Infrastructure for Algorithm- and Task-Level Scaling

Hive:一种用于算法和任务级扩展的多智能体基础设施

Zizhang Luo, Yuhao Luo, Youwei Xiao, Yansong Xu, Runlin Guo, Yun Liang

机构 * Peking University(北京大学)

专题命中 多智能体 :agent(title,summary_cn);multi-agent(title,abstract);workflow(abstract);agentic(abstract)

AI总结 Hive通过算法和任务级扩展提升智能体系统性能,通过Logits Cache减少冗余计算并提升采样速度,Agent-Aware Scheduling优化资源分配,降低热点缺失率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07341 2026-08-13 cs.SE cs.LG 版本更新 92%

ReCodeAgent: A Multi-agent Workflow for Language-Agnostic Translation and Validation of Large-Scale Repositories

ReCodeAgent:一种多智能体工作流用于语言无关的大规模仓库翻译与验证

Ali Reza Ibrahimzada, Brandon Paulsen, Daniel Kroening, Reyhaneh Jabbarvand

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Amazon(亚马逊)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(title);autonomous agent(abstract)

AI总结 ReCodeAgent通过多智能体方法实现大规模仓库代码翻译与验证的语言无关性,提升翻译正确率并降低成本,验证其效率和设计影响。

Comments Published in ASE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16022 2026-04-20 cs.AI cs.LG cs.MA 92%

SocialGrid: A Benchmark for Planning and Social Reasoning in Embodied Multi-Agent Systems

SocialGrid:一种用于具身多智能体系统规划与社交推理的基准测试

Hikaru Shindo, Hanzhao Lin, Lukas Helff, Patrick Schramowski, Kristian Kersting

机构 * Technical University of Darmstadt(达姆施塔特技术大学) German Research Center for Artificial Intelligence(德国人工智能研究中心) Lab1141(Lab1141实验室) Centre for Cognitive Science, Darmstadt(达姆施塔特认知科学中心)

专题命中 多智能体 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract);autonomous agent(abstract)

AI总结 SocialGrid通过评估LLM在具身多智能体环境中的规划、任务执行与社交推理能力,揭示了现有模型在任务完成和社交推理上的不足,并提供规划 oracle 和竞争排行榜以促进改进。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00623 2026-03-03 cs.AI cs.CL 92%

TraceSIR: A Multi-Agent Framework for Structured Analysis and Reporting of Agentic Execution Traces

TraceSIR: 一个用于结构化分析和报告代理执行轨迹的多代理框架

Shu-Xun Yang, Cunxiang Wang, Haoke Zhang, Wenbo Yu, Lindong Wu, Jiayi Gui, Dayong Yang, Yukuo Cen, Zhuoer Feng, Bosi Wen, Yidong Wang, Lucen Zhong, Jiamin Ren, Linfeng Zhang, Jie Tang

机构 * Beijing Institute of Technology(北京理工大学) Zhipu AI(智谱AI) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 多智能体 :agent(title,abstract);agentic(title,abstract);multi-agent(title,abstract);function calling(abstract)

AI总结 TraceSIR通过多代理框架结构化分析和报告代理执行轨迹,提升故障诊断和根本原因分析效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03743 2026-01-08 cs.CL cs.AI 92%

O-Researcher: An Open Ended Deep Research Model via Multi-Agent Distillation and Agentic RL

O-Researcher: 通过多智能体蒸馏和智能体强化学习构建开放式深度研究模型

Yi Yao, He Zhu, Piaohong Wang, Jincheng Ren, Xinlong Yang, Qianben Chen, Xiaowan Li, Dingfeng Shi, Jiaxian Li, Qiexiang Wang, Sinuo Wang, Xinpeng Liu, Jiaqi Wu, Minghao Liu, Wangchunshu Zhou

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(title);AI agent(abstract)

AI总结 O-Researcher通过多智能体蒸馏和智能体强化学习,构建开放式深度研究模型,实现开源模型在多个基准上的性能提升。

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏