arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-13 至 2026-07-13 共收录 19 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 19 篇

2607.09603 2026-07-13 cs.MA 新提交 91%

Mosaic: Runtime-Efficient Multi-Agent Embodied Planning

Mosaic:运行时高效的多智能体实体规划

Kunjal Panchal, Saayan Mitra, Sunav Choudhary, Victor Bursztyn, Somdeb Sarkhel, Hui Guan

专题命中 多智能体 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract)

AI总结 研究基于LLM的多智能体实体规划执行延迟高问题,提出Mosaic框架,通过智能体中心语义内存和整数线性规划应对挑战,在多基准测试中执行更快、调用更少、步数更少且成功率更高,证明相关因素对多智能体规划的重要性。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00651 2026-07-13 cs.AI cs.CL cs.IT cs.MA cs.NI math.IT 版本更新 91%

Leveraging Multi-Agent System (MAS) and Fine-Tuned Small Language Models (SLMs) for Automated Telecom Network Troubleshooting

利用多智能体系统(MAS)和微调后的小语言模型(SLM)实现电信网络自动化故障排除

Chenhua Shi, Bhavika Jalli, Gregor Macdonald, John Zou, Wanlu Lei, Mridul Jain, Joji Philip

机构 * Ericsson(爱立信)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);agentic(abstract)

AI总结 针对电信网络故障排除难题,提出基于多智能体系统(MAS)的方法,利用大语言模型协调专业工具,通过微调小语言模型生成修复计划,实现全自动故障排除,加速了无线接入网和核心网领域的故障排除自动化。

Comments 6 pages, 7 figures, 1 table, 2026 IEEE ICC Workshop on Wireless Foundation Models for AI-native 6G and Beyond

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20134 2026-07-13 cs.AI cs.ET quant-ph 版本更新 90%

QAgent: An LLM-based Multi-Agent System for Autonomous OpenQASM programming

QAgent:一种基于大语言模型的用于自主OpenQASM编程的多智能体系统

Zhenxiao Fu, Lei Jiang, Yilun Xu, Gang Huang, Fan Chen

机构 * Zhenxiao Fu1, Lei Jiang1, Yilun Xu2, Gang Huang2, Fan Chen1(作者1、作者2、作者3、作者4、作者5)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);workflow(abstract)

AI总结 研究针对OpenQASM编程挑战提出QAgent,它是基于大语言模型的多智能体系统,集成规划、合成和校准工作流程,利用检索增强生成及多智能体推理确保正确性,在多模型评估中表现出色,证明集成对可靠量子程序生成很关键。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14130 2026-07-13 cs.LG cs.MA 新提交 89%

Contract-Based Compositional Shielding for Safe Multi-Agent Reinforcement Learning

基于合约的组合屏蔽实现安全多智能体强化学习

Omar Adalat, Edwin Hamel-De le Court, Francesco Belardinelli

机构 * Imperial College London(伦敦帝国学院) University of Manchester(曼彻斯特大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 提出一种去中心化屏蔽方法,通过合约机制协调智能体局部LTL安全义务,在无集中运行时控制下保证全局安全并优化团队奖励。

Comments Accepted to EUMAS 2026, the 23rd European Conference on Multi-Agent Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17393 2026-07-13 cs.AI cs.LG cs.MA 版本更新 88%

Heterogeneous Information-Bottleneck Coordination Graphs for Multi-Agent Reinforcement Learning

异质信息瓶颈协调图用于多智能体强化学习

Wei Duan, Junyu Xuan, En Yu, Xiaoyu Yang, Jie Lu

机构 * Australian Artificial Intelligence Institute (AAII)(澳大利亚人工智能研究所)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出异质信息瓶颈协调图(HIBCG),通过理论指导机制解决多智能体强化学习中协调图的边存在性和信息传递容量分配问题,通过信息瓶颈方法构建组对齐的块对角先验,实现边存在性和信息容量的理论验证。

Comments Updated organization; corrected theoretical statements and proofs. Main paper + appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09403 2026-07-13 cs.AI 新提交 88%

Fictional Worldbuilding: Multi-Agent LLM Collaboration with Hierarchical Context Compression and Iterative Review

虚构世界构建:基于分层上下文压缩和迭代审查的多智能体大语言模型协作

Jingbo Chen, He Wang, Wei Yuan, Yuqiao Lai, Zhenyan Lu

机构 * National University of Defense Technology(国防科技大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 针对大语言模型应用于世界构建面临的挑战,提出AutoWorldBuilder多智能体协作系统,通过五个组件应对,经实验验证,该系统在世界构建任务中有高成功率,能高效生成自洽概念,其架构模式可推广到其他知识密集型多智能体大语言模型应用。

Comments 36 pages, 7 fig

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09153 2026-07-13 cs.AI 新提交 88%

KV-PRM: Efficient Process Reward Modeling via KV-Cache Transfer for Multi-Agent Test-Time Scaling

KV-PRM:通过KV缓存转移实现高效的过程奖励建模以进行多智能体测试时扩展

Peng Kuang, Haibo Jin, Xiaoyu Han, Yanli Wang, Xiaopeng Yuan, Ye Yu, Kaidi Xu, Haohan Wang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Imperial College London(伦敦帝国理工学院) City University of Hong Kong(香港城市大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 研究针对现有基于文本的过程奖励模型在长多智能体展开中评分成本高的问题,提出KV-PRM,通过读取KV缓存降低评分成本,经理论证明和实验验证,该模型在多基准测试及多种TTS方法下表现优异,大幅减少计算资源消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09101 2026-07-13 cs.SE 新提交 88%

Multi-Agent LLM Collaboration for Unit Test Generation via Human-Testing-Inspired Workflows

通过受人工测试启发的工作流程进行多智能体大语言模型协作以生成单元测试

Quanjun Zhang, Ye Shang, Siqi Gu, Jianyi Zhou, Chunrong Fang, Zhenyu Chen, Liang Xiao

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.SE

AI总结 研究针对现有基于大语言模型的单元测试生成方法的局限,提出TestAgent,通过多智能体协作机制模拟人工测试,设计专门智能体、配备工具API并构建知识图谱,在Java项目实验中取得优异结果,性能优于基线和搜索工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09099 2026-07-13 cs.AI 新提交 88%

L-MAD: A Systematic Evaluation of Multi-Agent Debate Structures in Legal Reasoning

L-MAD:法律推理中多智能体辩论结构的系统评估

Tan-Minh Nguyen, Hoang-Trung Nguyen, Huu-Dong Nguyen, Dinh-Truong Do, Thi-Hai-Yen Vuong, Le-Minh Nguyen

机构 * Japan Advanced Institute of Science(日本先进科学研究院) VNU University of Engineering(越南工程大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 研究在法律领域探索多智能体辩论(MAD)框架有效性,引入L-MAD框架评估不同结构和方法,通过分配专家角色提升效果,分析辩论规模发现权衡,明确了在法律推理中部署协作多智能体系统的边界与安全边际。

Comments Outstanding paper in the AI4Law Workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09422 2026-07-13 cs.LG cond-mat.mes-hall 新提交 88%

Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning

用于可扩展量子器件调谐的动作分解多智能体强化学习

Edwin De Nicolo, Rahul Marchand, Cornelius Carlsson, Pranav Vaidhyanathan, Natalia Ares

机构 * University of Oxford(牛津大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 针对量子器件调谐中参数串扰致学习不稳定问题,提出用在线学习动作空间分解表示的方法,框架QADAPT借此高效学习共享策略,实现零样本泛化及收敛步骤数恒定,为大规模量子处理器快速校准提供可扩展途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00138 2026-07-13 cs.LO cs.DC cs.MA cs.PL 版本更新 88%

JustAct: A Framework for Auditable Multi-Agent Systems Regulated by Inter-Organisational Policies

JustAct:一个由组织间政策监管的可审计多智能体系统框架

Christopher A. Esterhuyse, Tim Müller, L. Thomas van Binsbergen

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 研究跨越组织边界的开放多智能体系统中行动受复杂政策监管的问题,提出JustAct框架,智能体可凭动态政策信息证明行动合理,通过特定语言和系统的实例及案例研究展示评估该框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12920 2026-07-13 cs.MA cs.AI cs.CL 版本更新 87%

Embodied Multi-Agent Coordination by Aligning World Models Through Dialogue

通过对话对齐世界模型实现具身多智能体协调

Vardhan Dongre, Dilek Hakkani-Tür

机构 * Siebel School of Computing & Data Science(计算机与数据科学学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title);分类 cs.AI、cs.CL

AI总结 研究通过对话机制探索具身智能体的世界模型对齐,发现对话能减少冲突但降低任务成功率,提出评估世界模型对齐的框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09059 2026-07-13 cs.AI 新提交 86%

ARCANA: A Reflective Multi-Agent Program Synthesis Framework for ARC-AGI-2 Reasoning

ARCANA:用于ARC-AGI-2推理的反射式多智能体程序合成框架

Kunbo Zhang, Lei Fu, Zeyu Wang, Zijing Liu, Kejian Tong

机构 * Columbia University(哥伦比亚大学) University of California, Los Angeles(加州大学洛杉矶分校) Northeastern University(东北大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title);分类 cs.AI

AI总结 ARCANA是用于ARC-AGI-2推理的多智能体框架,将任务分解为感知、假设生成等步骤,智能体通过可微黑板通信,由元控制器调度。其设计结合程序搜索与校正,提升了抽象转换任务的推理效率和解决方案质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08960 2026-07-13 cs.LG cs.AI 新提交 86%

Eluna: An Agentic LLM System for Automating Warehouse Operations with Reasoning and Task Execution

Eluna:一个用于通过推理和任务执行实现仓库运营自动化的智能语言模型系统

Ning Liu, Kalle Kujanpää, Zhaoxuan Zhu, P Aditya Sreekar, Kaiwen Liu, Chuanneng Sun, Jorge Marchena Menendez, Matthew Bales, Tianyu Yang, Shahnawaz Alam, Rose Yu, Baoyuan Liu, Kristina Klinkner, Shervin Malmasi

机构 * Amazon.com, Inc. Fulfillment Technologies and Robotics(亚马逊公司履约技术与机器人部门)

专题命中 多智能体 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 研究针对仓库运营中SOP执行问题,提出Eluna智能体系统,它是图形引导多智能体框架,采用非对称情节蒸馏方法,在基准测试和生产应用中,微调模型表现出色,匹配或超教师模型,击败基线,在票务处理应用达94%专家一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09179 2026-07-13 cs.CR cs.SE 新提交 85%

Malaika: Understanding Malware through Tri-Grounded Agentic Reasoning

Malaika:通过三重基础的智能推理理解恶意软件

Xingzhi Qian, Xinran Zheng, Yiling He, Lorenzo Cavallaro

专题命中 多智能体 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.SE

AI总结 研究针对恶意软件理解挑战,将其视为基础推理问题,提出需三种基础形式。介绍多智能体框架Malaika,通过受分析师启发的推理等实现三种基础机制,用于安卓恶意软件分析,实验表明该框架提高分析质量,为可靠恶意软件理解及软件分析提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09011 2026-07-13 cs.CR cs.MA 新提交 82%

Secret Scanner Agent: Extracting Secrets and Access Context from Unstructured Documents

秘密扫描代理:从非结构化文档中提取秘密和访问上下文

Zixiao Chen, Mariko Wakabayashi, Charlotte Siska

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract)

AI总结 研究从非结构化文档提取秘密及访问上下文的问题,提出多智能体大语言模型系统SSA,它能通过检测与审查智能体配对提取相关信息,经合成基准评估,相比传统方法提升了提取精度、召回率,速度更快,让凭证检测更具可操作性。

Comments Submitted to the Conference on Applied Machine Learning for Information Security (CAMLIS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09587 2026-07-13 cs.RO 新提交 67%

CoDiMAD: Diffusion-Based Privileged Distillation for Communication-Free Multi-Robot Coordination

CoDiMAD:基于扩散的特权蒸馏用于无通信多机器人协调

Jiyue Tao, Shunheng Xin, Tongsheng Shen, Dexin Zhao, Feitian Zhang

机构 * Peking University(北京大学) National Innovation Institute of Defense Technology(国防科技创新研究院)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 研究无通信多机器人协调问题,提出CoDiMAD三阶段框架,先训练特权预言机,再构建数据集,最后将预言机蒸馏到学生智能体中,通过扩散反向过程采样动作,实验证明其性能优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03051 2026-07-13 econ.TH 版本更新 67%

On the sufficiency of unidirectional incentive compatibility in auctions

关于拍卖中单向激励相容的充分性

Kiho Yoon

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 研究在竞拍者只能低报真实估值时,单向激励相容对于收益最大化是否足以替代完全激励相容,并通过线性规划对偶性证明两者等价。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09330 2026-07-13 cs.AI cs.MA 新提交 57%

Communication-Efficient Digital-Twin Coordination for Heterogeneous LLM Embodied Agents over Computing Power Networks

基于计算能力网络的异构大语言模型实体代理的通信高效数字孪生协调

Nuocheng Yang, Sihua Wang, Zihan Chen, Tony Q. S. Quek, Changchuan Yin

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 多智能体 :agent(abstract);分类 cs.AI

AI总结 针对异构大语言模型实体代理协作面临的通信开销大、协调质量受LLMs能力限制和行动延迟等挑战,提出基于轻量级数字孪生的LDT-Coord框架,通过特定方法减少通信开销,实现与传统方法相当的任务成功率且保持鲁棒性。

Comments 14 pages, 6 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏