arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-17 至 2026-03-17 共收录 104 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 104 篇

2603.13594 2026-03-17 cs.AI cs.LG 91%

EnterpriseOps-Gym: Environments and Evaluations for Stateful Agentic Planning and Tool Use in Enterprise Settings

EnterpriseOps-Gym:面向企业场景的状态ful代理规划与工具使用的环境与评估

Shiva Krishna Reddy Malay, Shravan Nayak, Jishnu Sethumadhavan Nair, Sagar Davasam, Aman Tiwari, Sathwik Tejaswi Madhusudhan, Sridhar Krishna Nemala, Srinivas Sunkara, Sai Rajeswar

机构 * ServiceNow Research(ServiceNow研究院)

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);tool use(title);分类 cs.AI、cs.LG

AI总结 本文提出EnterpriseOps-Gym基准,用于评估企业环境中代理的规划能力。通过164个数据库表和512个功能工具模拟真实工作摩擦,评估14种前沿模型,发现状态-of-the-art模型在战略推理上存在显著不足,且代理常无法拒绝不可行任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20054 2026-03-17 cs.CV 89%

Marmot: Object-Level Self-Correction via Multi-Agent Reasoning

Marmot:通过多智能体推理实现对象级自校正

Jiayang Sun, Hongbo Wang, Jie Cao, Huaibo Huang, Ran He

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);AI agent(abstract)

AI总结 Marmot通过多智能体推理实现对象级自校正,提升图像文本对齐的准确性,解决多对象场景中计数、属性和空间关系的校正问题。

Journal ref Machine Intelligence Research, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14625 2026-03-17 cs.MA cs.AI cs.LG cs.SY eess.SY 88%

EcoFair-CH-MARL: Scalable Constrained Hierarchical Multi-Agent RL with Real-Time Emission Budgets and Fairness Guarantees

EcoFair-CH-MARL:具有实时排放预算和公平性保证的可扩展约束层次多智能体强化学习

Saad Alqithami

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出EcoFair-CH-MARL框架,通过引入双重预算层、公平性奖励转换器和两级策略架构,实现高效、可持续且公平的海运物流解决方案,实验显示其在排放、吞吐量和公平性方面优于现有方法。

Comments Conference: The 28th European Conference on Artificial Intelligence (ECAI)

Journal ref Frontiers in Artificial Intelligence and Applications, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15371 2026-03-17 cs.AI cs.NI 88%

Brain-Inspired Graph Multi-Agent Systems for LLM Reasoning

受脑启发的图多智能体系统用于LLM推理

Guangfu Hao, Yuming Dai, Xianzhe Qin, Shan Yu

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出受人类认知全局工作理论启发的BIGMAS系统,通过动态图结构和共享工作区提升多步推理能力,实验表明其在多个LLM上均优于现有多智能体基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13676 2026-03-17 cs.AI 88%

TheraAgent: Multi-Agent Framework with Self-Evolving Memory and Evidence-Calibrated Reasoning for PET Theranostics

TheraAgent:具有自我进化记忆和证据校准推理的多智能体框架用于PET治疗诊断

Zhihao Chen, Jiahui Wang, Yizhou Chen, Xiaozhong Ji, Xiaobin Hu, Jimin Hong, Wolfram Andreas Bosbach, Axel Rominger, Ali Afshar-Oromieh, Hongming Shan, Kuangyu Shi

机构 * Fudan University(复旦大学) University of Bern(伯尔尼大学) Nanjing University(南京大学) National University of Singapore(新加坡国立大学)

专题命中 规划决策 :agent(title);multi-agent(title);AI agent(abstract);agentic(abstract)

AI总结 TheraAgent通过自我进化记忆和证据校准推理,解决PET治疗诊断中数据稀缺、信息异构和证据推理的问题,实现75.7%的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08955 2026-03-17 cs.CL cs.AI cs.LG 85%

Imagine-then-Plan: Agent Learning from Adaptive Lookahead with World Models

想象后再计划:基于世界模型的自适应前瞻学习 agent 学习框架

Youwei Liu, Jian Wang, Hanlin Wang, Beichen Guo, Wenjie Li

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出Imagine-then-Plan框架,通过自适应前瞻机制提升agent在复杂任务中的推理能力,实验表明其优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14011 2026-03-17 cs.CR 85%

Sovereign-OS: A Charter-Governed Operating System for Autonomous AI Agents with Verifiable Fiscal Discipline

Sovereign-OS:一种以宪章治理为核心的自主AI代理操作系统,具有可验证的财政纪律

Aojie Yuan, Haiyue Zhang, Ziyi Wang, Yue Zhao

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);planning(abstract)

AI总结 Sovereign-OS通过宪章定义使命范围和财政限制,结合CEO、CFO、Worker和Auditor角色,实现对AI代理行为的宪法控制,有效阻止财政违规并确保审计完整性。

Comments 4 pages, 2 figures, 2 tables, demo paper. Code: https://github.com/Justin0504/Sovereign-OS Demo: https://youtu.be/vOarAI_epb4

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15364 2026-03-17 cs.AI cs.CL 84%

CRASH: Cognitive Reasoning Agent for Safety Hazards in Autonomous Driving

CRASH:面向自动驾驶安全隐患的认知推理代理

Erick Silva, Rehana Yasmin, Ali Shoker

机构 * King Abdullah University of Science and Technology(国王阿卜杜勒-阿齐兹科技大学)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 本文提出CRASH,一种基于大语言模型的自动驾驶安全隐患分析工具,通过自动化处理事故报告,识别事故原因并评估自动驾驶系统对事故的影响,验证其在事故分析中的有效性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09944 2026-03-17 cs.AI cs.CV cs.LG eess.IV 84%

Echo-CoPilot: A Multiple-Perspective Agentic Framework for Reliable Echocardiography Interpretation

Echo-CoPilot:一种多视角代理框架,用于可靠的超声心动图解读

Moein Heidari, Ali Mehrabian, Mohammad Amin Roohi, Wenjin Chen, David J. Foran, Jasmine Grewal, Ilker Hacihaliloglu

专题命中 规划决策 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Echo-CoPilot框架,结合多视角工作流程与知识图谱引导的测量选择,通过三个独立的ReAct式代理处理超声心动图任务,提升解读准确性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26255 2026-03-17 cs.AI cs.CV cs.LG cs.RO 84%

ExoPredicator: Learning Abstract Models of Dynamic Worlds for Robot Planning

ExoPredicator:为机器人规划学习动态世界的抽象模型

Yichao Liang, Dat Nguyen, Cambridge Yang, Tianyang Li, Joshua B. Tenenbaum, Carl Edward Rasmussen, Adrian Weller, Zenna Tavares, Tom Silver, Kevin Ellis

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出ExoPredicator框架,通过联合学习符号状态表示和因果过程,解决长周期具身规划中的外源性过程建模问题,实现对复杂任务的泛化能力。

Comments ICLR 2026. The last two authors contributed equally in co-advising

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.05586 2026-03-17 cs.RO cs.AI 84%

Interpretable Responsibility Sharing as a Heuristic for Task and Motion Planning

可解释的责任共享作为任务与运动规划的启发式方法

Arda Sarp Yenicesu, Sepehr Nourmohammadi, Berk Cicek, Ozgur S. Oguz

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出了一种名为可解释责任共享(IRS)的新型启发式方法,用于提升家用机器人任务与运动规划的效率,通过利用人类构建的环境和固有偏见,结合辅助物体简化任务执行。

Comments Accepted for the Special Issue "Planning and Learning for Autonomous Robotics" in Robotics and Autonomous Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15386 2026-03-17 cs.CV cs.AI 83%

RieMind: Geometry-Grounded Spatial Agent for Scene Understanding

RieMind:基于几何的场景理解空间智能体

Fernando Ropero, Erkin Turkoz, Daniel Matos, Junqing Du, Antonio Ruiz, Yanfeng Zhang, Lu Liu, Mingwei Sun, Yongliang Wang

机构 * Riemann Lab, Huawei Technologies(华为技术有限公司里斯曼实验室)

专题命中 规划决策 :agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出RieMind,通过显式3D场景图实现空间推理,证明解耦感知与推理能显著提升空间推理能力,实验结果显示比现有方法提升16%-50%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15260 2026-03-17 cs.AI cs.CV 83%

AGCD: Agent-Guided Cross-Modal Decoding for Weather Forecasting

AGCD:面向天气预报的代理引导跨模态解码

Jing Wu, Yang Liu, Lin Zhang, Junbo Zeng, Jiabin Wang, Zi Ye, Guowen Li, Shilei Cao, Jiashun Cheng, Fang Wang, Meng Jin, Yerong Feng, Hong Cheng, Yutong Lu, Haohuan Fu, Juepeng Zheng

机构 * Sun Yat-sen University(中山大学) The Chinese University of Hong Kong(香港中文大学) Jiangxi Science and Technology Normal University(江西科技师范大学) China Meteorological Administration(中国气象局) Huawei Technologies Co., Ltd(华为技术有限公司) Guangdong-Hong Kong-Macao Greater Bay Area Weather Research Center for Monitoring Warning and Forecasting(粤港澳大湾区气象监测预警与预报研究中心) National Supercomputing Center in Shenzhen(深圳国家超算中心) Tsinghua University(清华大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 AGCD通过在解码时注入状态条件化的物理先验,提升天气预报的结构一致性和物理一致性,实验显示在不同分辨率和模型上均取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02046 2026-03-17 cs.CV cs.AI 83%

Agentic Retoucher for Text-To-Image Generation

面向文本到图像生成的代理修复器

Shaocheng Shen, Jianfeng Liang, Chunlei Cai, Cong Geng, Huiyu Duan, Xiaoyun Zhang, Qiang Hu, Guangtao Zhai

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出Agentic Retoucher框架,通过感知-推理-行动循环改进文本到图像生成的质量,引入GenBlemish-27K数据集进行评估,提升图像真实感与局部修正可靠性。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13245 2026-03-17 cs.AI 83%

Automating Document Intelligence in Statutory City Planning

在法定城市规划中自动化文档智能

Lars Malmqvist, Robin Barber

机构 * Research and Implementation(研究与实施)

专题命中 规划决策 :planning(title,abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出一种集成AI系统,通过自动化识别和脱敏个人信息、提取元数据及分析建筑图纸,减轻规划官员处理大量文档的负担,降低合规风险。

Comments Accepted for presentation at Computing Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14393 2026-03-17 cs.RO 82%

From Scanning Guidelines to Action: A Robotic Ultrasound Agent with LLM-Based Reasoning

从扫描指南到行动:基于LLM的机器人超声代理

Yuan Bi, Yiping Zhou, Pei Liu, Feng Li, Zhongliang Jiang, Nassir Navab

专题命中 规划决策 :agent(title,abstract);planning(abstract)

AI总结 本文提出一种基于LLM的自主机器人超声扫描框架,通过动态调用软件工具实现自主扫描,提升适应性和透明度。

Comments Code: https://github.com/yuan-12138/RUSSAgent; Video: https://youtu.be/pfMOc4e2IGA

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13906 2026-03-17 cs.DB 82%

ATCC: Adaptive Concurrency Control for Unforeseen Agentic Transactions

ATCC:面向意外代理事务的自适应并发控制

Weixing Zhou, Zhiyou Wang, Zeshun Peng, Hetian Chen, Yanfeng Zhang, Ge Yu

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 本文提出ATCC,一种针对意外代理事务的自适应并发控制方法,通过动态调整乐观与悲观执行策略,显著提升事务吞吐量并降低尾部延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14486 2026-03-17 cs.CL cs.AI 81%

Infinite Problem Generator: Verifiably Scaling Physics Reasoning Data with Agentic Workflows

无限问题生成器:通过代理工作流可验证地扩展物理推理数据

Aditya Sharan, Sriram Hebbale, Dhruv Kumar

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出IPG框架,通过公式-as-代码方法生成可解物理问题,解决大语言模型训练中高质量数据稀缺的问题,发布包含1335个经典力学问题的ClassicalMechanicsV1数据集,展示高结构多样性及复杂度与代码长度的强相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14312 2026-03-17 cs.AI cond-mat.dis-nn cs.LG cs.MA q-bio.BM 81%

Autonomous Agents Coordinating Distributed Discovery Through Emergent Artifact Exchange

自主代理通过涌现式物品交换协调分布式发现

Fiona Y. Wang, Lee Marom, Subhadeep Pal, Rachel K. Luu, Wei Lu, Jaime A. Berkovich, Markus J. Buehler

专题命中 规划决策 :autonomous agent(title);agent(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出ScienceClaw + Infinite框架,通过自主代理在无中央协调下进行科学探究,展示异构工具链、代理间涌现式收敛及可追溯推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14229 2026-03-17 cs.AI cs.SE 81%

Agentic DAG-Orchestrated Planner Framework for Multi-Modal, Multi-Hop Question Answering in Hybrid Data Lakes

基于代理的DAG编排规划框架:用于混合数据湖中多模态、多跳问答系统

Kirushikesh D B, Manish Kesarwani, Nishtha Madaan, Sameep Mehta, Aldrin Dennis, Siddarth Ajay, Rakesh B R, Renu Rajagopal, Sudheesh Kairali

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.SE

AI总结 本文提出A.DOT规划框架,通过编译自然语言查询为DAG执行计划,实现多模态多跳问答,提升准确性和效率,并生成可追溯的证据链。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13443 2026-03-17 cs.SE cs.AI cs.PL 81%

NormCode Canvas: Making LLM Agentic Workflows Development Sustainable via Case-Based Reasoning

NormCode Canvas:通过基于案例的推理使LLM代理工作流开发可持续

Xin Guan, Yunshan Li, Ze Wang

机构 * Psylens AI, China(Psylens AI,中国) Shenzhen University, China(深圳大学,中国) University College London, United Kingdom(伦敦大学学院,英国)

专题命中 规划决策 :agentic(title);planning(abstract);分类 cs.AI、cs.SE

AI总结 NormCode Canvas通过基于案例的推理实现多步骤LLM工作流的可持续开发,其核心是NormCode语言,确保每个执行检查点都是自包含的案例,从而消除隐含共享状态带来的问题。

Comments 16 pages, 5 figures. Submitted to ICCBR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15280 2026-03-17 cs.AI 79%

Advancing Multimodal Agent Reasoning with Long-Term Neuro-Symbolic Memory

通过长期神经符号记忆推进多模态代理推理

Rongjie Jiang, Jianwei Wang, Gengda Zhao, Chengyang Luo, Kai Wang, Wenjie Zhang

机构 * University of New South Wales(新南威尔士大学) Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出NS-Mem框架,结合神经记忆与符号结构,提升多模态代理的推理能力,实验证明其在推理准确率上优于纯神经记忆系统。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13888 2026-03-17 cs.LG 79%

Tractable Probabilistic Models for Investment Planning

可计算的概率模型用于投资规划

Nicolas M. Cuadrado A., Mohannad Takrouri, Jiří Němeček, Martin Takáč, Jakub Mareček

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文提出基于可计算概率模型的投资规划方法,利用求和-乘积网络(SPNs)高效表示高维不确定性,支持精确概率查询,用于嵌入机会约束的混合整数线性规划模型以评估可靠性事件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14704 2026-03-17 cs.LG cs.CV stat.ML 79%

Chain-of-Trajectories: Unlocking the Intrinsic Generative Optimality of Diffusion Models via Graph-Theoretic Planning

轨迹链:通过图论规划解锁扩散模型的内在生成最优性

Ping Chen, Xiang Liu, Xingpeng Zhang, Fei Shen, Xun Gong, Zhaoxiang Liu, Zezhou Chen, Huan Hu, Kai Wang, Shiguo Lian

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文提出轨迹链框架,通过图论规划解决扩散模型在高维状态空间中的计算瓶颈,提升生成质量与稳定性。

Comments 12 figues, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14057 2026-03-17 cs.AI 79%

Demand-Driven Context: A Methodology for Building Enterprise Knowledge Bases Through Agent Failure

需求驱动的上下文:通过智能体失败构建企业知识库的方法论

Raj Navakoti, Saideep Navakoti

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出需求驱动上下文方法,通过智能体失败信号来获取企业领域知识,解决传统知识工程方法的局限性,展示在零售订单履行中的应用案例。

Comments 18 pages, 5 figures, 1 algorithm. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13956 2026-03-17 cs.AI 79%

EviAgent: Evidence-Driven Agent for Radiology Report Generation

EviAgent:基于证据的放射学报告生成代理

Tuoshi Qi, Shenshen Bu, Yingfei Xiang, Zhiming Dai

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 EviAgent通过引入多维视觉专家和检索机制,解决放射学报告生成中的透明性与证据支持问题,实验表明其在多个数据集上优于通用和专用模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13360 2026-03-17 eess.IV cs.CV cs.LG q-bio.QM 79%

PREDICT-GBM: A multi-center platform to advance personalized glioblastoma radiotherapy planning

PREDICT-GBM:一个多中心平台以推进个性化胶质瘤放疗规划

L. Zimmer, J. Weidner, M. Balcerak, F. Kofler, M. Krupa, I. Ezhov, S. Cepeda, R. Zhang, J. Lowengrub, B. Menze, B. Wiestler

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文提出PREDICT-GBM平台,整合多中心数据集和标准化评估流程,开发并验证了基于U-Net的复发预测模型,显著提升了放疗规划的个性化水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13433 2026-03-17 cs.RO cs.AI 79%

Spatially Grounded Long-Horizon Task Planning in the Wild

在真实环境中进行具有长时域的任务规划

Sehun Jung, HyunJee Song, Dong-Hee Kim, Reuben Tan, Jianfeng Gao, Yong Jae Lee, Donghyun Kim

机构 * Korea University(韩国大学) Microsoft Research(微软研究院) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种基于空间的规划任务,引入了GroundedPlanBench基准,评估机器人在真实环境中的长时域动作规划能力,并通过V2GP框架提升空间接地规划性能。

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23197 2026-03-17 cs.RO cs.AI 79%

Balancing Safety and Optimality in Robot Path Planning: Algorithm and Metric

在机器人路径规划中平衡安全性和最优性:算法与度量

Jatin Kumar Arora, Soutrik Bandyopadhyay, Sunil Sulania, Shubhendu Bhasin

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出统一路径规划算法UPP,通过自适应启发式加权动态平衡安全与最优性,引入OptiSafe指标评估,实验证明在复杂环境中性能优于现有方法。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15160 2026-03-17 eess.SY cs.SY math.DS 78%

Multi-Scale Control of Large Agent Populations: From Density Dynamics to Individual Actuation

多尺度控制大规模群体:从密度动力学到个体驱动

Mario di Bernardo

专题命中 规划决策 :agent(title,abstract)

AI总结 本文综述了作者与合作者在多尺度控制大规模群体方面的最新研究,探讨了从微观动态到宏观密度描述的系统性桥梁,以及直接控制与间接控制的统一方法。

详情

展开后加载摘要…

URL PDF HTML 收藏