arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-11 至 2026-03-11 共收录 136 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 50 篇

2603.09835 2026-03-11 cs.CL 70%

Chow-Liu Ordering for Long-Context Reasoning in Chain-of-Agents

Chow-Liu 排序用于链式代理中的长上下文推理

Naman Gupta, Vaibhav Singh, Arun Iyer, Kirankumar Shiragur, Pratham Grover, Ramakrishna B. Bairi, Ritabrata Maiti, Sankarshan Damle, Shachee Mishra Gupta, Rishikesh Maurya, Vageesh D. C

机构 * Microsoft(微软)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 本文利用Chow-Liu树学习依赖结构,通过广度优先遍历优化块顺序,减少信息损失并提升长上下文推理的准确率。

Comments Published as a workshop paper at ICLR 2026 Workshop MemAgents

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09400 2026-03-11 cs.CL 70%

Reward Prediction with Factorized World States

基于分解世界状态的奖励预测

Yijun Shen, Delong Chen, Xianming Hu, Jiaming Mi, Hongbo Zhao, Kai Zhang, Pascale Fung

机构 * East China Normal University(华东师范大学) HKUST(香港科技大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.CL

AI总结 本文提出StateFactory方法,通过分解世界状态实现跨领域的准确奖励预测,提升智能体规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08317 2026-03-11 cs.CL 70%

Automatic Paper Reviewing with Heterogeneous Graph Reasoning over LLM-Simulated Reviewer-Author Debates

基于异构图推理的自动论文评审:LLM模拟的评审者-作者辩论

Shuaimin Li, Liyang Fan, Yufang Lin, Zeyang Li, Xian Wei, Shiwen Ni, Hamid Alinejad-Rokny, Min Yang

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 ReViewGraph通过异构图推理分析LLM模拟的评审者-作者辩论,提升论文评审的准确性和细致程度。

Journal ref AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17174 2026-03-11 cs.LG cs.AI cs.SY eess.SY 62%

Continual uncertainty learning

持续不确定性学习

Heisei Yonezawa, Ansei Yonezawa, Itsuro Kajiwara

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出基于课程的学习框架,用于鲁棒控制问题中的多重不确定性处理,通过分解复杂问题为持续学习任务,提升学习效率和控制器鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09086 2026-03-11 cs.RO cs.AI cs.LG cs.MA cs.SY eess.SY 62%

Latent World Models for Automated Driving: A Unified Taxonomy, Evaluation Framework, and Open Challenges

潜在世界模型用于自动驾驶:一种统一的分类法、评估框架和开放挑战

Rongxiang Zeng, Yongqi Dong

机构 * RWTH Aachen University(亚琛工业大学) Delft University of Technology(代尔夫特理工大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出统一的潜在空间框架,整合自动驾驶世界模型的最新进展,探讨潜在表示的分类、评估方法及未来研究方向。

Comments 17 pages, 6 figures, under review by IEEE Transactions on Intelligent Transportation Systems (IEEE-T-ITS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08773 2026-03-11 cs.LG cs.AI stat.ML 62%

Multi-level meta-reinforcement learning with skill-based curriculum

基于技能的多级元强化学习

Sichen Yang, Mauro Maggioni

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于技能的多级元强化学习框架,通过多级分解和策略分解实现技能转移,提升复杂MDP的求解效率与泛化能力。

Comments 78 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09916 2026-03-11 eess.SY cs.AI cs.SY 57%

AI-Enabled Data-driven Intelligence for Spectrum Demand Estimation

基于人工智能的数据驱动智能用于频谱需求估计

Colin Brown, Mohamad Alkadamani, Halim Yanikomeroglu

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出基于人工智能的数据驱动方法,利用机器学习模型准确预测频谱需求,通过验证代理提升预测精度,助力频谱资源的动态规划与管理。

Comments Presented at an IEEE ICC 2025 Workshop and published in the conference proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09599 2026-03-11 cs.SE 57%

Preparing Students for AI-Driven Agile Development: A Project-Based AI Engineering Curriculum

为AI驱动的敏捷开发培养学生:一种基于项目的AI工程课程

Andreas Rausch, Stefan Wittek, Tobias Geger, David Inkermann

专题命中 规划决策 :agentic(abstract);分类 cs.SE

AI总结 本文提出一种基于项目的AI工程课程,通过整合敏捷实践与AI赋能的工程,培养学生在AI驱动的敏捷开发中的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09532 2026-03-11 stat.ML cs.LG 57%

What Do We Care About in Bandits with Noncompliance? BRACE: Bandits with Recommendations, Abstention, and Certified Effects

在非合规带隙中我们关心什么?BRACE:带隙推荐、弃权和认证效果

Nicolás Della Penna

机构 * Grouplang

专题命中 规划决策 :workflow(abstract);分类 cs.LG

AI总结 BRACE算法针对非合规带隙问题,通过结构区间和固定间隙识别,实现推荐和治疗政策的有效性与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09481 2026-03-11 cs.AI 57%

GenePlan: Evolving Better Generalized PDDL Plans using Large Language Models

GenePlan: 利用大语言模型改进PDDL计划的进化方法

Andrew Murray, Danial Dervovic, Alberto Pozanco, Michael Cashmore

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 GenePlan利用大语言模型改进PDDL计划的进化方法,通过优化问题生成高效且低成本的通用计划器,实现了与最先进方法相近的性能。

Comments 54 pages, 4 figures. Accepted to ICAPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09415 2026-03-11 cs.RO cs.AI 57%

From Flow to One Step: Real-Time Multi-Modal Trajectory Policies via Implicit Maximum Likelihood Estimation-based Distribution Distillation

从流到一步:通过隐式最大似然估计基于的分布蒸馏实现实时多模轨迹策略

Ju Dong, Liding Zhang, Lei Zhang, Yu Fu, Kaixin Bai, Zoltan-Csaba Marton, Zhenshan Bing, Zhaopeng Chen, Alois Christian Knoll, Jianwei Zhang

机构 * TAMS (Technical Aspects of Multimodal Systems), Department of Informatics, University of Hamburg(汉堡大学信息学院TAMS(多模态系统技术方面)) Technical University of Munich(慕尼黑技术大学) Agile Robots SE(敏捷机器人公司)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 通过隐式最大似然估计基于的分布蒸馏,实现实时多模轨迹策略,提升机器人操作的高频闭环控制与鲁棒性。

Comments https://sites.google.com/view/flow2one, 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09353 2026-03-11 cs.LG 57%

Interactive 3D visualization of surface roughness predictions in additive manufacturing: A data-driven framework

在增材制造中交互式可视化表面粗糙度预测:一种数据驱动的框架

Engin Deniz Erkan, Elif Surer, Ulas Yaman

机构 * Department of Data Informatics, Graduate School of Informatics, Middle East Technical University(数据信息系,信息科学研究生院,中东部技术大学) Department of Modeling and Simulation, Graduate School of Informatics, Middle East Technical University(建模与仿真系,信息科学研究生院,中东部技术大学) Department of Mechanical Engineering, Middle East Technical University(机械工程系,中东部技术大学) Welding Technology and NDT Center, Middle East Technical University(焊接技术与无损检测中心,中东部技术大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出了一种数据驱动框架,通过交互式3D可视化预测增材制造中的表面粗糙度,利用多层感知机和生成对抗网络提高预测性能,并提供决策支持界面。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20601 2026-03-11 cs.CV cs.AI 57%

CLEAR-Mamba:Towards Accurate, Adaptive and Trustworthy Multi-Sequence Ophthalmic Angiography Classification

CLEAR-Mamba: 向准确、适应和可信的多序列眼底angiography分类迈进

Zhuonan Wang, Wenjie Yan, Wenqiao Zhang, Xiaohui Song, Jian Ma, Ke Yao, Yibo Yu, Beng Chin Ooi

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 CLEAR-Mamba通过优化架构和训练策略,提升多序列眼底angiography分类的准确性和可靠性。

Comments 12 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14932 2026-03-11 cs.RO cs.LG 57%

Robot Control Stack: A Lean Ecosystem for Robot Learning at Scale

机器人控制栈:一个用于大规模机器人学习的轻量生态系统

Tobias Jülg, Pierre Krack, Seongjin Bien, Yannik Blei, Khaled Gamal, Ken Nakahara, Johannes Hechtl, Roberto Calandra, Wolfram Burgard, Florian Walter

机构 * Department of Computer Science & Artificial Intelligence, University of Technology Nuremberg(技术大学纽伦堡计算机科学与人工智能系) Learning, Adaptive Systems and Robotics (LASR) Lab, Faculty of Computer Science, TU Dresden(德累斯顿技术大学计算机科学学院学习、适应系统与机器人实验室) Siemens Foundational Technologies, Siemens AG(西门子基础技术部,西门子股份公司) Chair for Robotics, Artificial Intelligence and Real-Time Systems, TUM School of Computation, Information and Technology, Technical University of Munich(慕尼黑技术大学计算、信息与技术学院机器人、人工智能与实时系统教授职位)

专题命中 规划决策 :workflow(abstract);分类 cs.LG

AI总结 机器人控制栈(RCS)是一个为大规模机器人学习设计的轻量生态系统,通过模块化架构和统一接口,促进模拟到现实的迁移,并评估了多种策略在不同机器人上的性能。

Comments Accepted at ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09090 2026-03-11 cs.LG 57%

Overcoming Valid Action Suppression in Unmasked Policy Gradient Algorithms

克服未遮蔽策略梯度算法中的有效动作抑制

Renos Zabounidis, Roy Siegelmann, Mohamad Qadri, Woojun Kim, Simon Stepputtis, Katia P. Sycara

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 该研究揭示了未遮蔽策略梯度算法中有效动作抑制的机制,并通过实验验证了可行性分类在无需oracle遮蔽的部署中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08865 2026-03-11 cs.NI cs.LG cs.RO 57%

Why Channel-Centric Models are not Enough to Predict End-to-End Performance in Private 5G: A Measurement Campaign and Case Study

为什么以通道为中心的模型不足以预测私有5G的端到端性能:一次测量活动和案例研究

Nils Jörgensen

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文通过测量发现,基于信道的模型无法准确预测5G端到端性能,而高斯过程模型能显著减少预测误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10696 2026-03-11 stat.ML cs.LG math.OC math.ST stat.TH 57%

Robust Assortment Optimization from Observational Data

从观测数据中稳健的 assortment 优化

Miao Lu, Yuxuan Han, Han Zhong, Zhengyuan Zhou, Jose Blanchet

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出了一种稳健的数据驱动 assortments 优化框架,通过考虑客户选择行为的潜在分布变化,实现了样本高效且稳健的 assortments 学习。

Comments 65 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10631 2026-03-11 cs.CG 50%

Minimum Star Partitions of Simple Polygons in Polynomial Time

简单多边形的最小星形划分的多项式时间算法

Mikkel Abrahamsen, Joakim Blikstad, André Nusser, Hanwen Zhang

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种多项式时间算法,用于将简单多边形划分为最少数量的星形多边形,解决了长期存在的开放问题。

Comments 68 pages. This is the TheoretiCS journal version

Journal ref TheoretiCS, Volume 5 (January 13, 2026) theoretics:15339

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09808 2026-03-11 eess.SP 50%

A Hybrid Model-Assisted Approach for Path Loss Prediction in Suburban Scenarios

一种混合模型辅助方法用于郊区路径损耗预测

Chenlong Wang, Bo Ai, Ruiming Chen, Ruisi He, Mi Yang, Yuxin Zhang, Weirong Liu, Liu Liu

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种混合模型辅助方法,通过环境自适应补偿和联合预测路径损耗指数,提升郊区路径损耗预测的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09579 2026-03-11 eess.SP 50%

Low-Rank Cyclostationarity Predictive Routing Is Almost as Good as Real-Time Data-based Routing

低秩循环平稳性预测路由几乎与基于实时数据的路由一样好

Oriel-Singer, Ilai-Bistritz, Giseung-Park, Woohyeon-Byeon, Youngchul-Sung, Amir-Leshem

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种基于低秩分解的交通预测方法,证明其在预测旅行时间方面与实时数据方法相当,适用于离线交通规划任务。

Comments 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09428 2026-03-11 stat.AP 50%

Bayesian Species Distribution Models using Hierarchical Decomposition Priors

使用分层分解先验的贝叶斯物种分布模型

Luisa Ferrari, Massimo Ventrucci, Alex Laini

专题命中 规划决策 :workflow(abstract)

AI总结 本文提出了一种基于分层分解先验的贝叶斯物种分布模型,通过改进的先验控制提升模型的可解释性和透明度。

Comments 43 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09407 2026-03-11 math.AT 50%

On the topological complexity of non-simply connected spaces

非单连通空间的拓扑复杂性

Yuki Minowa

专题命中 规划决策 :planning(abstract)

AI总结 本文研究了非单连通空间的拓扑复杂性,通过引入上同调类和谱序列,扩展了现有结果并确定了某些3流形的拓扑复杂性。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10778 2026-03-11 cs.RO 50%

Asset-Centric Metric-Semantic Maps of Indoor Environments

以资产为中心的度量-语义地图:室内环境

Christopher D. Hsu, Pratik Chaudhari

机构 * Department of Electrical & Systems Engineering and General Robotics, Automation, Sensing and Perception (GRASP) Laboratory at the University of Pennsylvania(宾夕法尼亚大学电气与系统工程系及通用机器人、自动化、传感与感知(GRASP)实验室) DEVCOM Army Research Laboratory(陆军研究实验室)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种以资产为中心的度量-语义地图方法,利用四足机器人和RGB-D数据构建室内环境的高精度表示,结合自然语言和网格信息,提升机器人场景理解和导航能力。

Comments 9 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17270 2026-03-11 math.OC 50%

Existence and Uniqueness of Physically Correct Hydraulic States in Water Distribution Systems -- A theoretical analysis on the solvability of non-linear systems of equations in the context of water distribution systems

水分布系统中物理正确水力状态的存在与唯一性 -- 水分布系统非线性方程组可解性的理论分析

Janine Strotherm, Julian Rolfes, Barbara Hammer

专题命中 规划决策 :planning(abstract)

AI总结 本文理论分析了水分布系统中非线性方程组的可解性,证明了物理正确水力状态的存在与唯一性,为水力模拟器提供理论保障。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09083 2026-03-11 cs.RO 50%

Provably Safe Trajectory Generation for Manipulators Under Motion and Environmental Uncertainties

在运动和环境不确定性下为机械臂提供可证明安全的轨迹生成

Fei Meng, Zijiang Yang, Xinyu Mao, Haobo Liang, Max Q. -H. Meng

机构 * Hong Kong Center for Construction Robotics, The Hong Kong University of Science and Technology(香港建设机器人中心,香港理工大学) Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(机械与自动化工程系,中国香港大学) Department of Electronic Engineering, The Chinese University of Hong Kong(电子工程系,中国香港大学) Shenzhen Key Laboratory of Robotics Perception and Intelligence and the Department of Electronic and Electrical Engineering at Southern University of Science and Technology(深圳机器人感知与智能重点实验室和南方科技大学电子与电气工程系) Department of Electronic Engineering at The Chinese University of Hong Kong(电子工程系,中国香港大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种可证明安全的轨迹生成框架,通过整合深度随机Koopman操作符模型和分层验证方法,有效应对运动和环境不确定性下的碰撞风险问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08831 2026-03-11 cs.RO cs.SY eess.SY 50%

Predictive Control with Indirect Adaptive Laws for Payload Transportation by Quadrupedal Robots

四足机器人负载运输的间接自适应律预测控制

Leila Amanzadeh, Taizoon Chunawala, Randall T. Fawcett, Alexander Leonessa, Kaveh Akbari Hamed

机构 * Department of Mechanical Engineering, Virginia Tech(机械工程系,弗吉尼亚理工学院)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种基于间接自适应律的预测控制框架,用于四足机器人在复杂地形中稳健运输未知负载。

Comments 8 pages, 6 figures. Published in IEEE Robotics and Automation Letters

Journal ref IEEE Robotics and Automation Letters, vol. 9, no. 11, pp. 10359-10366, Nov. 2024

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 16 篇

2603.09152 2026-03-11 cs.AI cs.DB cs.IR 90%

DataFactory: Collaborative Multi-Agent Framework for Advanced Table Question Answering

DataFactory: 用于高级表格问答的协作多智能体框架

Tong Wang, Chi Jin, Yongkang Chen, Huan Deng, Xiaohui Kuang, Gang Zhao

机构 * Institute of Systems Engineering, Academy of Military Sciences(系统工程研究所,军事科学院) School of Information Resource Management, Renmin University of China(信息资源管理学院,中国人民大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);workflow(abstract)

AI总结 DataFactory通过多智能体协作框架提升表格问答的准确性和鲁棒性,采用ReAct范式和自动知识转换,显著提高查询精度和多跳推理能力。

Comments Published in Information Processing & Management, 2026

Journal ref Information Processing & Management, 63(6):104723, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09733 2026-03-11 cs.CV cs.MA 90%

FetalAgents: A Multi-Agent System for Fetal Ultrasound Image and Video Analysis

FetalAgents:一种用于胎儿超声图像和视频分析的多智能体系统

Xiaotian Hu, Junwei Huang, Mingxuan Liu, Kasidit Anmahapong, Yifei Chen, Yitong Luo, Yiming Huang, Xuguang Bai, Zihan Li, Yi Liao, Haibo Qu, Qiyuan Tian

机构 * Tsinghua University(清华大学) University of California San Diego(加州大学圣地亚哥分校) West China Second University Hospital, Sichuan University(四川大学华西第二医院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);agentic(abstract)

AI总结 FetalAgents是一种多智能体系统,通过动态协调视觉专家,实现胎儿超声图像和视频的端到端分析与报告,提供高准确性和流程对齐的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07409 2026-03-11 eess.SY cs.LG cs.MA cs.RO cs.SY 89%

Learning responsibility allocations for multi-agent interactions: A differentiable optimization approach with control barrier functions

多智能体交互中的责任分配学习:一种基于可微优化与控制屏障函数的方法

Isaac Remy, David Fridovich-Keil, Karen Leung

机构 * University of Washington, Department of Aeronautics and Astronautics(华盛顿大学航空航天系) University of Texas, Austin, Department of Aerospace Engineering and Engineering Mechanics(得克萨斯大学奥斯汀分校航空航天工程与工程力学系) NVIDIA

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract);分类 cs.LG

AI总结 本文提出一种基于控制屏障函数和可微优化的方法,用于学习多智能体交互中的责任分配,通过数据驱动的方式实现对安全交互行为的可解释性分析。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04265 2026-03-11 cs.MA cs.AI cs.GT cs.LG 88%

Cooperative Game-Theoretic Credit Assignment for Multi-Agent Policy Gradients via the Core

基于核心的协同博弈信用分配:通过核心的多智能体策略梯度

Mengda Ji, Genjiu Xu, Keke Jia, Zekun Duan, Yong Qiu, Jianjun Ge, Mingqiang Li

机构 * Key Laboratory of Intelligence, Games and Information Processing in Shaanxi Province(陕西省智能信息处理重点实验室) Unmanned System Research Institute(无人系统研究院) Northwestern Polytechnical University(西北工业大学) School of Mathematics and Statistics(数学与统计学院) Information Science Academy(信息科学学院) China Electronics Technology Group Corporation(中国电子科技集团有限公司)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出CORA方法,通过核心分配机制解决多智能体策略梯度中的信用分配问题,提升联盟策略的协调优化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏