arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35313 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35313 篇

2603.07370 2026-03-10 cs.LG 88%

Learning to Reflect: Hierarchical Multi-Agent Reinforcement Learning for CSI-Free mmWave Beam-Focusing

学习反射:面向无CSI毫米波波束聚焦的分层多智能体强化学习

Hieu Le, Oguz Bedir, Mostafa Ibrahim, Jian Tao, Sabit Ekin

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文提出一种无CSI的分层多智能体强化学习框架,用于毫米波波束聚焦,通过用户定位数据替代CSI估计,实现高效且鲁棒的反射表面控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14899 2026-03-10 cs.AI cs.CV 88%

InsightX Agent: An LMM-based Agentic Framework with Integrated Tools for Reliable X-ray NDT Analysis

InsightX Agent: 一种基于LMM的智能框架,集成工具用于可靠X射线无损检测分析

Jiale Liu, Huan Wang, Yue Zhang, Xiaoyu Luo, Jiaxiang Hu, Zhiliang Liu, Min Xie

机构 * School of Physics and Astronomy, The University of Edinburgh(物理学与天文学学院,爱丁堡大学) Glasgow College, University of Electronic Science and Technology of China(电子科技大学成都学院) School of Mechanical and Electrical Engineering, University of Electronic Science and Technology of China(机械与电子工程学院,电子科技大学) Department of Systems Engineering, City University of Hong Kong(系统工程系,香港城市大学)

专题命中 规划决策 :agent(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 InsightX Agent基于LMM构建智能框架,集成工具提升X射线检测的可靠性与可解释性,实现主动推理与高质量分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05120 2026-03-06 cs.AI 88%

Bidirectional Curriculum Generation: A Multi-Agent Framework for Data-Efficient Mathematical Reasoning

双向课程生成:一种用于数据高效数学推理的多智能体框架

Boren Hu, Xiao Liu, Boci Peng, Xinping Zhao, Xiaoran Shang, Yun Zhu, Lijun Wu

机构 * Zhejiang University(浙江大学) University of Macau(澳门大学) Peking University(北京大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Wuhan University(武汉大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出双向课程生成框架,通过多智能体系统动态生成数据以提升数学推理效率,优化学习轨迹并减少训练样本需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02701 2026-03-04 cs.CL 88%

Graph-GRPO: Stabilizing Multi-Agent Topology Learning via Group Relative Policy Optimization

图GRPO:通过群体相对策略优化稳定多智能体拓扑学习

Yueyang Cang, Xiaoteng Zhang, Erlu Zhao, Zehua Ji, Yuhang Liu, Yuchen He, Zhiyuan Ning, Chen Yijun, Wenge Que, Li Shi

机构 * Tsinghua University(清华大学) Donghua University(东华大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 图GRPO通过群体相对策略优化稳定多智能体拓扑学习,提升训练稳定性并识别关键通信路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23725 2026-03-04 cs.AI 88%

MedLA: A Logic-Driven Multi-Agent Framework for Complex Medical Reasoning with Large Language Models

MedLA:基于大语言模型的复杂医学推理多智能体框架

Siqi Ma, Jiajie Huang, Fan Zhang, Yue Shen, Jinlin Wu, Guohui Fan, Zhu Zhang, Zelin Zang

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 MedLA是一种基于大语言模型的逻辑驱动多智能体框架,通过多轮图引导讨论实现透明推理和共识达成,有效提升复杂医学推理性能。

Comments accepted by AAAI-26 (ORAL)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23577 2026-03-02 cs.CL 88%

Multi-Agent Causal Reasoning for Suicide Ideation Detection Through Online Conversations

多智能体因果推理用于通过在线对话检测自杀念头

Jun Li, Xiangmeng Wang, Haoyang Li, Yifei Yan, Shijie Zhang, Hong Va Leong, Ling Feng, Nancy Xiaonan Yu, Qing Li

机构 * The Hong Kong Polytechnic University, Hong Kong, China(香港理工大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 本文提出多智能体因果推理框架,通过扩展用户互动和减轻隐藏偏见来提高在线对话中自杀念头检测的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21533 2026-02-26 cond-mat.mtrl-sci cs.LG 88%

Reasoning-Driven Design of Single Atom Catalysts via a Multi-Agent Large Language Model Framework

通过多智能体大语言模型框架进行基于推理的单原子催化剂设计

Dong Hyeon Mok, Seoin Back, Victor Fung, Guoxiang Hu

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文提出一种多智能体大语言模型框架,用于基于推理的单原子催化剂设计,通过迭代推理和上下文学习发现高性能催化剂并突破传统缩放关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21351 2026-02-26 cs.AI cs.IR cs.MA 88%

A Hierarchical Multi-Agent System for Autonomous Discovery in Geoscientific Data Archives

面向地质数据档案的分层多智能体系统

Dmitrii Pantiukhin, Ivan Kuznetsov, Boris Shapkin, Antonia Anna Jost, Thomas Jung, Nikolay Koldunov

机构 * Alfred Wegener Institute for Polar and Marine Research(阿尔弗雷德·韦格ener极地和海洋研究所)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 PANGAEA-GPT通过分层多智能体框架实现地质数据自动发现与分析,具备复杂工作流执行能力,减少人工干预。

Comments 20 pages, 6 figures, 7 tables, supplementary material included

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07667 2026-02-26 cs.AI 88%

1-2-3 Check: Enhancing Contextual Privacy in LLM via Multi-Agent Reasoning

1-2-3 Check: 通过多智能体推理增强LLM的上下文隐私

Wenkai Li, Liwen Sun, Zhenxiang Guan, Xuhui Zhou, Maarten Sap

机构 * Language Technologies Institute Carnegie Mellon University(语言技术研究所卡内基梅隆大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 通过多智能体推理,有效减少LLM中的私有信息泄露,提升上下文隐私保护效果。

Comments Accepted at the International Association for AI Safety and Ethics AI (IASEAI) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20196 2026-02-25 cs.CR cs.AI 88%

OpenPort Protocol: A Security Governance Specification for AI Agent Tool Access

OpenPort 协议:AI 代理工具访问的安全治理规范

Genliang Zhu, Chu Wang, Ziyuan Wang, Zhida Li, Qiang Li

机构 * Accentrust Georgia Institute of Technology(阿肯色州立大学) Accentrust University of Illinois Urbana-Champaign(阿肯色州立大学) Duke University(杜克大学) New York Institute of Technology-Vancouver(纽约理工学院-温哥华分校) Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

AI总结 OpenPort 协议通过安全治理规范实现AI代理工具访问的可控性和安全性,提供风险门控生命周期、授权模型和审计机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18663 2026-02-24 cs.RO cs.LG 88%

Toward AI Autonomous Navigation for Mechanical Thrombectomy using Hierarchical Modular Multi-agent Reinforcement Learning (HM-MARL)

迈向机械取栓的AI自主导航:基于分层模块多智能体强化学习(HM-MARL)

Harry Robertshaw, Nikola Fischer, Lennart Karstensen, Benjamin Jackson, Xingyu Chen, S. M. Hadi Sadati, Christos Bergeles, Alejandro Granados, Thomas C Booth

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本研究提出分层模块多智能体强化学习框架,实现机械取栓中双设备自主导航,展示体外导航能力及泛化挑战。

Comments Published in IEEE Robotics and Automation Letters

Journal ref IEEE Robotics and Automation Letters (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14160 2026-02-17 cs.AI 88%

Process-Supervised Multi-Agent Reinforcement Learning for Reliable Clinical Reasoning

过程监督多智能体强化学习用于可靠的临床推理

Chaeeun Lee, T. Michael Yates, Pasquale Minervini, T. Ian Simpson

机构 * School of Informatics, University of Edinburgh, UK(信息学院,爱丁堡大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出了一种过程监督的多智能体强化学习框架,用于提升基因-疾病有效性校准的临床推理准确性与过程忠实度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15414 2026-02-13 cs.AI 88%

MARSHAL: Incentivizing Multi-Agent Reasoning via Self-Play with Strategic LLMs

通过战略性大语言模型的自我对战激励多智能体推理的MARSHAL

Huining Yuan, Zelai Xu, Zheyue Tan, Xiangmin Yi, Mo Guang, Kaiwen Long, Haojia Hui, Boxun Li, Xinlei Chen, Bo Zhao, Xiao-Ping Zhang, Chao Yu, Yu Wang

机构 * SIGS, Tsinghua University(清华大学信号与系统系) EE, Tsinghua University(清华大学电子工程系) Aalto University(阿alto大学) Li Auto Inc.(李汽车公司) Infinigence AI Project Page Code Models(Infinigence AI项目页面代码模型)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 MARSHAL通过战略性LLM的自我对战激励多智能体推理,实现多智能体系统的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11416 2026-02-13 cs.CR cs.LG 88%

Optimizing Agent Planning for Security and Autonomy

优化安全与自主性的智能体规划

Aashish Kolluri, Rishi Sharma, Manuel Costa, Boris Köpf, Tobias Nießen, Mark Russinovich, Shruti Tople, Santiago Zanella-Béguelin

专题命中 规划决策 :agent(title,abstract);planning(title);AI agent(abstract);分类 cs.LG

AI总结 本文提出了一种安全意识智能体,通过增强人工监督交互和规划任务进展与政策合规性,提高自主性并减少对人工监督的依赖。

Comments 33 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11170 2026-02-13 cs.CL 88%

PRIME: Policy-Reinforced Iterative Multi-agent Execution for Algorithmic Reasoning in Large Language Models

PRIME:基于策略强化的迭代多智能体执行框架用于大语言模型中的算法推理

Jiawei Xu, Zhenyu Yu, Ziqian Bi, Minh Duc Pham, Xiaoyi Qu, Danyang Zhang

机构 * Purdue University(普渡大学) University of Malaya(马来亚大学) Faculty of Information Technology, Beijing University of Technology(北京理工大学信息学院) School of Computer Science, Georgia Institute of Technology(佐治亚理工学院计算机科学学院) Department of Industrial and Systems Engineering, Lehigh University(莱斯大学工业与系统工程系)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 PRIME通过多智能体框架提升大语言模型在算法推理中的性能,显著提高复杂任务的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16839 2026-02-13 cs.AI 88%

Roundtable Policy: Confidence-Weighted-Consensus Aggregation Improves Multi-Agent-System Reasoning

圆桌政策:置信度加权共识聚合提升多智能体系统推理

Yu Yao, Jiayi Dong, Yang Yang, Ju Li, Yilun Du

机构 * mit(麻省理工学院)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 圆桌政策通过多语言模型加权共识提升多智能体系统在复杂科学任务中的推理能力

Comments Project page: https://ai4scidisc.github.io/roundtable/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09341 2026-02-11 cs.AI 88%

Auditing Multi-Agent LLM Reasoning Trees Outperforms Majority Vote and LLM-as-Judge

对多智能体大语言模型推理树进行审计优于多数投票和LLM作为裁判

Wei Yang, Shixuan Li, Heng Ping, Peiyu Zhang, Paul Bogdan, Jesse Thomason

机构 * University of Southern California, Los Angeles, CA, USA(美国南加州大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 通过构建推理树路径搜索机制,AgentAuditor在多智能体系统中实现了优于多数投票和LLM作为裁判的推理准确性提升

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11276 2026-02-11 cs.HC cs.AI 88%

Words to Describe What I'm Feeling: Exploring the Potential of AI Agents for High Subjectivity Decisions in Advance Care Planning

描述我感受的词语:探索AI代理在前瞻性医疗计划中的潜在作用

Kellie Yu Hui Sim, Pin Sym Foong, Chenyu Zhao, Melanie Yi Ning Quek, Swarangi Subodh Mehta, Kenny Tsu Wei Choo

机构 * Singapore University of Technology and Design(新加坡科技设计大学) National University of Singapore(国立新加坡大学)

专题命中 规划决策 :planning(title,abstract);AI agent(title);agent(abstract);分类 cs.AI

AI总结 本文探讨了AI代理在前瞻性医疗计划中的应用,通过实验发现AI可作为个人倡导者,提升个体与代理之间的相互理解。

Comments Accepted at CHI 2026. 34 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12777 2026-02-11 cs.MA cs.AI 88%

Multi-Agent Reinforcement Learning Simulation for Environmental Policy Synthesis

多智能体强化学习模拟用于环境政策综合

James Rudd-Jones, Mirco Musolesi, María Pérez-Ortiz

机构 * Centre for Artificial Intelligence, Department of Computer Science, University College London(人工智能研究中心,计算机科学系,伦敦大学学院) Department of Computer Science and Engineering, University of Bologna(计算机科学与工程系,博洛尼亚大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出利用多智能体强化学习增强气候模拟,以解决政策综合中的非线性动态、异质智能体和不确定性量化等挑战。

Comments Published in AAMAS'25 Blue Sky Ideas Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08603 2026-02-10 cs.AI 88%

OSCAR: Optimization-Steered Agentic Planning for Composed Image Retrieval

OSCAR:基于优化的代理规划用于组合图像检索

Teng Wang, Rong Shan, Jianghao Lin, Junjie Wu, Tianyi Xu, Jianping Zhang, Wenteng Chen, Changwang Zhang, Zhaoxiang Wang, Weinan Zhang, Jun Wang

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 OSCAR通过优化引导的代理规划框架,提升组合图像检索的性能,仅用10%训练数据即超越现有最佳方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07733 2026-02-10 cs.AI 88%

SurveyG: A Multi-Agent LLM Framework with Hierarchical Citation Graph for Automated Survey Generation

SurveyG: 一种基于分层引用图的多智能体LLM框架用于自动化综述生成

Minh-Anh Nguye, Minh-Duc Nguyen, Ha Lan N. T., Kieu Hai Dang, Nguyen Tien Dong, Dung D. Le

机构 * CMC OpenAI, VinUniversity(CMC OpenAI与 VinUniversity) VinUniversity

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 SurveyG通过分层引用图和多智能体验证生成结构化的综述,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07186 2026-02-10 cs.MA cs.LG 88%

The Value of Variance: Mitigating Debate Collapse in Multi-Agent Systems via Uncertainty-Driven Policy Optimization

方差的价值:通过不确定性驱动的策略优化缓解多智能体系统中的辩论崩溃

Luoxi Tang, Yuqiao Meng, Joseph Costa, Yingxue Zhang, Muchao Ye, Zhaohan Xi

机构 * Department of Computer Science, Binghamton University, Binghamton, NY, USA(宾夕法尼亚州立大学计算机科学系) University of Iowa, Iowa City, IA, USA(爱荷华大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文提出了一种基于不确定性驱动的策略优化方法,通过量化多智能体系统中的不确定性来缓解辩论崩溃问题,提升决策准确性和系统一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08641 2026-02-06 cs.AI q-fin.TR 88%

Resisting Manipulative Bots in Meme Coin Copy Trading: A Multi-Agent Approach with Chain-of-Thought Reasoning

抵制操纵机器人在表情包加密货币复制交易中的应用:一种基于多智能体的链式推理方法

Yichen Luo, Yebo Feng, Jiahua Xu, Yang Liu

机构 * UCL, Centre for Blockchain Technologies(伦敦大学区块链技术中心) The University of Hong Kong, FinTech Academy(香港大学金融科技学院) Nanyang Technological University(南洋理工大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出一种基于多智能体和链式推理的复制交易系统,以抵御操纵机器人,通过多模态大语言模型提升预测准确度和经济表现,实现加密货币投资的稳健收益。

Journal ref Proceedings of the ACM Web Conference 2026 (WWW'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04112 2026-02-05 cs.CL 88%

DELTA: Deliberative Multi-Agent Reasoning with Reinforcement Learning for Multimodal Psychological Counseling

DELTA: 基于强化学习的多智能体推理用于多模态心理辅导

Jiangnan Yang, Junjie Chen, Fei Wang, Yiqi Nie, Yuxin Liu, Zhangling Duan, Jie Chen

机构 * Anhui University(安徽大学) Hefei University of Technology(合肥工业大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合国家科学中心人工智能研究所)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 DELTA 通过强化学习和多智能体推理提升多模态心理辅导的质量与情感契合度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03414 2026-02-04 cs.CV cs.AI 88%

Socratic-Geo: Synthetic Data Generation and Geometric Reasoning via Multi-Agent Interaction

Socratic-Geo:通过多智能体交互实现合成数据生成与几何推理

Zhengbo Jiao, Shaobo Wang, Zifan Zhang, Wei Wang, Bing Zhao, Hu Wei, Linfeng Zhang

机构 * AI DATA, Alibaba Group Holding Limited(阿里数据,阿里巴巴集团控股有限公司) EPIC Lab, Shanghai Jiao Tong University(上海交通大学EPIC实验室) Shanghai University of Finance(上海财经大学) Wuhan University(武汉大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 Socratic-Geo通过多智能体交互实现合成数据生成与几何推理,利用教师代理和求解代理动态耦合数据合成与模型学习,提升图像生成和推理能力。

Comments 18pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00127 2026-02-03 cs.LG 88%

ALIGN: Aligned Delegation with Performance Guarantees for Multi-Agent LLM Reasoning

ALIGN: 多智能体LLM推理中的对齐委托与性能保证

Tong Zhu, Baiting Chen, Jin Zhou, Hua Zhou, Sriram Sankararaman, Xiaowu Dai

机构 * Department of Biostatistics, UCLA(生物统计学系,加州大学洛杉矶分校) Department of Statistics and Data Science, UCLA(统计学与数据科学系,加州大学洛杉矶分校) Department of Computer Science, UCLA(计算机科学系,加州大学洛杉矶分校) Departments of Statistics and Data Science, and of Biostatistics, UCLA(统计学与数据科学系和生物统计学系,加州大学洛杉矶分校)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 ALIGN通过多智能体对齐委托机制,提升大语言模型在复杂推理任务中的性能保障与表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21936 2026-01-30 cs.AI 88%

AgenticSimLaw: A Juvenile Courtroom Multi-Agent Debate Simulation for Explainable High-Stakes Tabular Decision Making

AgenticSimLaw: 一个面向可解释高风险表格决策的青少年法庭多智能体辩论模拟

Jon Chun, Kathrine Elkins, Yong Suk Lee

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 AgenticSimLaw通过结构化多智能体辩论框架提升高风险表格决策的可解释性和稳定性,适用于需要透明和人类监督的决策任务。

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21113 2026-01-30 cs.AI cs.MA 88%

Planner-Auditor Twin: Agentic Discharge Planning with FHIR-Based LLM Planning, Guideline Recall, Optional Caching and Self-Improvement

计划-审核双胞胎:基于FHIR的LLM计划、指南回忆、可选缓存和自我改进的代理出院计划

Kaiyuan Wu, Aditya Nagori, Rishikesan Kamaleswaran

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 基于FHIR的LLM计划与审核框架,通过自我改进和缓存优化,提升临床出院计划的安全性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20676 2026-01-29 cs.CL 88%

Efficient Multimodal Planning Agent for Visual Question-Answering

高效的多模态规划代理用于视觉问答

Zhuo Chen, Xinyu Geng, Xinyu Wang, Yong Jiang, Zhen Zhang, Pengjun Xie, Kewei Tu

机构 * ShanghaiTech University(上海科技大学) Alibaba Tongyi Lab(阿里云通义实验室)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);分类 cs.CL

AI总结 本文提出了一种高效的多模态规划代理,通过动态分解mRAG流程,提升视觉问答任务的效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16167 2026-01-29 cs.NI cs.LG cs.MA 88%

Hierarchical Multi-Agent DRL Based Dynamic Cluster Reconfiguration for UAV Mobility Management

基于层次多智能体深度强化学习的动态集群重构用于无人机移动管理

Irshad A. Meer, Karl-Ludwig Besser, Mustafa Ozger, Dominic Schupke, H. Vincent Poor, Cicek Cavdar

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本文提出基于层次多智能体深度强化学习的动态集群重构方法,用于提升无人机移动管理的效率与可扩展性。

Comments 15 pages, 7 figures

Journal ref IEEE Transactions on Cognitive Communications and Networking, vol. 12, pp. 4957-4971, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏