arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-12 至 2026-03-12 共收录 42 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 42 篇

2603.10852 2026-03-12 cs.CV 89%

UltrasoundAgents: Hierarchical Multi-Agent Evidence-Chain Reasoning for Breast Ultrasound Diagnosis

超声波智能体:用于乳腺超声诊断的层次多智能体证据链推理

Yali Zhu, Kang Zhou, Dingbang Wu, Gaofeng Meng

机构 * Institute of Automation, Chinese Academy of Sciences, Beijing, China(中国科学院自动化研究所,北京,中国) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences, Beijing, China(中国科学院大学(大学层面)交叉学科学院,北京,中国) Centre for Artificial Intelligence and Robotics, Hong Kong Institute of Science & Innovation, Chinese Academy of Sciences, Hong Kong(人工智能与机器人中心,香港创新科学研究院,中国科学院,香港)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract)

AI总结 UltrasoundAgents通过层次多智能体框架实现乳腺超声诊断中的证据链推理,提升诊断准确性和证据可追溯性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08719 2026-03-12 cs.AR cs.AI cs.SE 88%

SiliconMind-V1: Multi-Agent Distillation and Debug-Reasoning Workflows for Verilog Code Generation

SiliconMind-V1:用于Verilog代码生成的多智能体蒸馏与调试推理工作流

Mu-Chi Chen, Yu-Hung Kao, Po-Hsuan Huang, Shao-Chun Ho, Hsiang-Yu Tsou, I-Ting Wu, En-Ming Huang, Yu-Kai Hung, Wei-Po Hsin, Cheng Liang, Chia-Heng Tu, Shih-Hao Hung, H. T. Kung

机构 * SiliconMind-V1

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.SE

AI总结 SiliconMind-V1通过多智能体框架和测试平台驱动的验证,实现了更高效且功能正确的Verilog代码生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10764 2026-03-12 cs.CL 86%

HeartAgent: An Autonomous Agent System for Explainable Differential Diagnosis in Cardiology

HeartAgent:一种用于心血管疾病可解释性差分诊断的自主代理系统

Shuang Zhou, Kai Yu, Song Wang, Wenya Xie, Zaifu Zhan, Meng-Han Tsai, Yuen-Hei Chung, Shutong Hou, Huixue Zhou, Min Zeng, Bhavadharini Ramu, Lin Yee Chen, Feng Xie, Rui Zhang

专题命中 规划决策 :agent(title,abstract);autonomous agent(title);分类 cs.CL

AI总结 HeartAgent通过整合定制工具和数据资源,提供可解释的差分诊断支持,显著提升心血管疾病诊断的准确性和解释质量。

Comments 26 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01776 2026-03-12 cs.LG 85%

Position: Beyond Model-Centric Prediction -- Agentic Time Series Forecasting

位置:超越模型导向的预测——代理时间序列预测

Mingyue Cheng, Xiaoyu Tao, Qi Liu, Ze Guo, Enhong Chen

专题命中 规划决策 :agentic(title,abstract);planning(abstract);workflow(abstract);分类 cs.LG

AI总结 本文提出代理时间序列预测框架,强调通过代理流程实现动态适应与持续学习,推动时间序列预测方法的革新。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01607 2026-03-12 cs.AI cs.LG 84%

CARE: Towards Clinical Accountability in Multi-Modal Medical Reasoning with an Evidence-Grounded Agentic Framework

CARE:迈向多模态医学推理中的临床问责的证据基础代理框架

Yuexi Du, Jinglu Wang, Shujie Liu, Nicha C. Dvornek, Yan Lu

机构 * Microsoft Research Asia(微软亚洲研究院) Department of Biomedical Engineering, Yale University(耶鲁大学生物医学工程系) Department of Radiology & Biomedical Imaging, Yale University(耶鲁大学放射学与生物医学成像系)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 CARE通过证据基础的代理框架提升多模态医学推理的准确性与问责性,结合解耦的专业模型和明确证据,实现更可靠的医学AI。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10092 2026-03-12 cs.CR cs.AI 83%

Execution Is the New Attack Surface: Survivability-Aware Agentic Crypto Trading with OpenClaw-Style Local Executors

执行是新的攻击面:面向OpenClaw风格的生存意识代理加密交易

Ailiya Borjigin, Igor Stadnyk, Ben Bilski, Serhii Hovorov, Sofiia Pidturkina

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出SAE,一种针对OpenClaw风格系统的生存意识执行标准,通过定义执行合同和强制执行不变量,提高代理加密交易的生存能力。

Comments 26 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09141 2026-03-12 cs.CV 82%

Agentic AI as a Network Control-Plane Intelligence Layer for Federated Learning over 6G

代理AI作为6G联邦学习的网络控制平面智能层

Loc X. Nguyen, Ji Su Yoon, Huy Q. Le, Yu Qiao, Avi Deb Raha, Eui-Nam Huh, Nguyen H. Tran, Zhu Han, Choong Seon Hong

机构 * Department of Computer Science and Engineering, Kyung Hee University(韩国庆熙大学计算机科学与工程系) Department of Artificial Intelligence, Kyung Hee University(韩国庆熙大学人工智能系) School of Computer Science, The University of Sydney(悉尼大学计算机科学学院) Electrical and Computer Engineering Department, University of Houston(德克萨斯大学休斯顿分校电子与计算机工程系)

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 本研究提出一种基于代理AI的网络控制平面智能层,用于6G网络中的联邦学习,通过整合学习与网络管理任务,提升系统在多样化数据训练和严格约束下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06934 2026-03-12 cs.GT cs.MA stat.ME stat.OT 81%

Sequential Causal Normal Form Games: Theory, Computation, and Strategic Signaling

顺序因果正常形式游戏:理论、计算与战略信号

Dennis Thumm

专题命中 规划决策 :agentic(abstract,comments);agent(abstract);AI agent(abstract);multi-agent(abstract)

AI总结 本文探讨了经典博弈论框架能否扩展以捕捉AI代理的有限理性与因果推理,通过引入顺序因果多智能体系统(S-CMAS),发现其在所有测试场景中无法提供福利改进,揭示了理性选择与因果推理的不兼容性。

Comments AAAI 2026 Workshop on Foundations of Agentic Systems Theory

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10800 2026-03-12 cs.LG cs.AI cs.SY eess.SY 81%

AI-Enhanced Spatial Cellular Traffic Demand Prediction with Contextual Clustering and Error Correction for 5G/6G Planning

基于上下文聚类和误差校正的AI增强型空间蜂窝交通需求预测用于5G/6G规划

Mohamad Alkadamani, Colin Brown, Halim Yanikomeroglu

机构 * Innovation, Science and Economic Development Canada (ISED) and Carleton University(创新、科学与经济发展的加拿大(ISED)和卡尔顿大学) Communications Research Centre (CRC)(通讯研究中心(CRC)) Carleton University(卡尔顿大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于上下文聚类和误差校正的AI框架,用于提高5G/6G规划中空间蜂窝交通需求预测的准确性与可靠性。

Comments 5 pages, 8 figures. Submitted to IEEE Wireless Communications Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13043 2026-03-12 cs.CV cs.AI 79%

GTR-Turbo: Merged Checkpoint is Secretly a Free Teacher for Agentic VLM Training

GTR-Turbo:合并的检查点实际上是为代理VLM训练提供免费的教师

Tong Wei, Yijun Yang, Changhao Zhang, Junliang Xing, Yuanchun Shi, Zongqing Lu, Deheng Ye

机构 * Tsinghua University(清华大学) Tencent Hunyuan(腾讯文生) Peking University(北京大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 GTR-Turbo通过合并检查点作为免费教师,提升了多模态代理训练的效率和效果。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06658 2026-03-12 cs.RO cs.AI 79%

Self-Improving Loops for Visual Robotic Planning

自改进循环用于视觉机器人规划

Calvin Luo, Zilai Zeng, Mingxi Jia, Yilun Du, Chen Sun

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 SILVR通过自生成轨迹迭代更新视频模型,实现视觉机器人任务的持续改进,无需人类演示或奖励函数。

Comments ICLR 2026. Project Page: https://diffusion-supervision.github.io/silvr/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10675 2026-03-12 cs.RO 78%

Cybo-Waiter: A Physical Agentic Framework for Humanoid Whole-Body Locomotion-Manipulation

Cybo-Waiter:一个人形全身体态运动- manipulation的物理代理框架

Peng Ren, Haoyang Ge, Chuan Qi, Cong Huang, Hong Li, Jiang Zhao, Pei Chi, Kai Chen

专题命中 规划决策 :agentic(title);agent(abstract)

AI总结 Cybo-Waiter提出了一种人形全身体态运动-操作的物理代理框架,通过多对象3D几何监督和条件诊断提升任务执行的鲁棒性与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10585 2026-03-12 eess.SP 78%

Path Planning for Sound Speed Profile Estimation

声速剖面估计的路径规划

Ludvig Lindström, Tadas Paskevicius, Andreas Jakobsson, Isaac Skog

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出利用AUV结合CTD和TL测量,通过无迹卡尔曼滤波和递推时间规划策略,实现水下声速剖面的高精度估计,提升声学系统环境表征能力。

Comments Submitted to FUSION 2026, Trondheim, 6 pages, 7 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09394 2026-03-12 cs.HC 78%

EyeAgent: An Agentic AI System for Multimodal Clinical Decision Support in Ophthalmology

EyeAgent:一种用于眼科多模态临床决策支持的智能AI系统

Danli Shi, Xiaolan Chen, Bingjie Yan, Weiyi Zhang, Pusheng Xu, Jiancheng Yang, Ruoyu Chen, Siyu Huang, Bowen Liu, Xinyuan Wu, Meng Xie, Ziyu Gao, Yue Wu, Senlin Lin, Kai Jin, Xia Gong, Yih Chung Tham, Xiujuan Zhang, Li Dong, Yuzhou Zhang, Jason Yam, Guangming Jin, Xiaohu Ding, Haidong Zou, Yalin Zheng, Zongyuan Ge, Mingguang He

专题命中 规划决策 :agentic(title,abstract)

AI总结 EyeAgent通过整合53种眼科工具提升诊断准确率,实现多模态临床决策支持,为眼科AI系统提供新范式。

Comments 28 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16410 2026-03-12 cs.CV 78%

REALM: An MLLM-Agent Framework for Open World 3D Reasoning Segmentation and Editing on Gaussian Splatting

REALM:一种用于高斯点划法上开放世界3D推理分割和编辑的MLLM-代理框架

Changyue Shi, Minghao Chen, Yiping Mao, Chuxiao Yang, Xinyuan Hu, Jiajun Ding, Zhou Yu

机构 * Hangzhou Dianzi University(杭州电子科技大学) Peking University(北京大学)

专题命中 规划决策 :agent(title,abstract)

AI总结 REALM通过MLLM-代理框架实现开放世界3D推理分割和编辑,支持多种3D交互任务。

Comments CVPR 2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08253 2026-03-12 cs.RO 78%

Open-World Task and Motion Planning via Vision-Language Model Generated Constraints

开放世界任务与运动规划 via 视觉-语言模型生成的约束

Nishanth Kumar, William Shen, Fabio Ramos, Dieter Fox, Tomás Lozano-Pérez, Leslie Pack Kaelbling, Caelan Reed Garrett

机构 * NVIDIA Research(NVIDIA研究) MIT CSAIL

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出OWL-TAMP方法,通过整合视觉-语言模型生成的约束,提升开放世界任务与运动规划的性能,实现对自然语言目标的处理能力。

Comments A version of this paper appears in IEEE Robotics and Automation Letters (RA-L) Volume 11, Issue 3

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10392 2026-03-12 cs.RO cs.AI 74%

Safe Probabilistic Planning for Human-Robot Interaction using Conformal Risk Control

利用符合风险控制的人机交互安全概率规划

Jake Gonzales, Kazuki Mizuta, Karen Leung, Lillian J. Ratliff

机构 * University of Washington, Department of Electrical and Computer Engineering(华盛顿大学电气与计算机工程系) University of Washington, Department of Aeronautics and Astronautics(华盛顿大学航空与航天系)

专题命中 规划决策 :planning(title);分类 cs.AI

AI总结 本文提出结合控制屏障函数与符合风险控制的方法,以提高人机交互中的安全性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09836 2026-03-12 math.OC cs.LG cs.RO cs.SY eess.SY 74%

Score Matching Diffusion Based Feedback Control and Planning of Nonlinear Systems

基于分数匹配扩散的非线性系统反馈控制与规划

Karthik Elamvazhuthi, Darshan Gadginmath, Fabio Pasqualetti

机构 * T-5 Applied Mathematics and Plasma Physics Group, Los Alamos National Laboratory(T-5应用数学与等离子体物理组,洛斯阿拉莫斯国家实验室) Department of Mechanical Engineering, University of California, Riverside(加州大学河滨分校机械工程系) Electrical Engineering and Computer Science, University of California, Irvine(加州大学欧文分校电气工程与计算机科学)

专题命中 规划决策 :planning(title);分类 cs.LG

AI总结 本文提出基于分数匹配扩散的非线性系统反馈控制与规划方法,通过确定性反向过程实现可控无漂移和LTI系统的密度控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14482 2026-03-12 cs.CV cs.AI 70%

TikArt: Stabilizing Aperture-Guided Fine-Grained Visual Reasoning with Reinforcement Learning

TikArt: 通过强化学习稳定引导孔细粒度视觉推理

Hao Ding, Zhichuan Yang, Weijie Ge, Ziqin Gao, Chaoyi Lu, Lei Zhao

专题命中 规划决策 :agent(abstract);tool use(abstract);分类 cs.AI

AI总结 TikArt通过强化学习引导孔机制提升细粒度视觉推理,结合语言推理与Zoom、Segment操作,实现多模态证据获取与持久记忆。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10521 2026-03-12 cs.AI cs.CL cs.CR cs.LG 67%

IH-Challenge: A Training Dataset to Improve Instruction Hierarchy on Frontier LLMs

IH-Challenge: 一个改进前沿大语言模型指令层级的训练数据集

Chuan Guo, Juan Felipe Ceron Uribe, Sicheng Zhu, Christopher A. Choquette-Choo, Steph Lin, Nikhil Kandpal, Milad Nasr, Rai, Sam Toyer, Miles Wang, Yaodong Yu, Alex Beutel, Kai Xiao

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 IH-Challenge通过强化学习训练数据集提升前沿大语言模型在指令冲突中的鲁棒性,减少不安全行为并提高帮助性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07527 2026-03-12 cs.AI cs.LG 62%

Learning What Reinforcement Learning Can't: Interleaved Online Fine-Tuning for Hardest Questions

学习强化学习无法做到的:用于最难问题的交错在线微调

Lu Ma, Hao Liang, Meiyi Qiang, Lexiang Tang, Xiaochen Ma, Zhen Hao Wong, Junbo Niu, Chengyu Shen, Runming He, Yanhao Li, Bin Cui, Wentao Zhang

机构 * Peking University(北京大学) Zhongguancun Academy(中关村学院) Beijing Key Laboratory of Data Intelligence and Security (Peking University)(北京数据智能与安全重点实验室(北京大学)) Beijing Key Laboratory of Software and Hardware Cooperative Artificial Intelligence Systems(北京软件与硬件协同人工智能系统重点实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 ReLIFT通过结合强化学习和在线微调,提升模型在复杂问题上的推理能力,实现超过5.2分的性能提升。

Comments 12 pages, 5 figures

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10887 2026-03-12 cs.LG cs.AI 62%

Dynamics-Predictive Sampling for Active RL Finetuning of Large Reasoning Models

动态预测采样用于主动强化学习微调大推理模型

Yixiu Mao, Yun Qu, Qi Wang, Heming Zou, Xiangyang Ji

机构 * Department of Automation, Tsinghua University(清华大学自动化系)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 DPS通过动态预测方法减少回放成本,提升大推理模型的强化学习微调效率与性能。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18045 2026-03-12 stat.ME cs.AI cs.LG 62%

Conformal Tradeoffs: Operational Profiles Beyond Coverage

符合性权衡:超越覆盖的操作配置文件

Petrus H. Zwart

机构 * Center for Advanced Mathematics in Energy Research Applications(能源研究应用高级数学中心) Synchrotron Infrared Structural Biology Program(同步辐射红外结构生物学计划) Molecular Biophysics and Integrated Bioimaging Division(分子生物物理与整合生物成像部)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出SSBC方法,通过校准与审计机制,在有限样本下实现精确覆盖语义,并通过诱导划分揭示制度边界和权衡问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17923 2026-03-12 cs.AI 61%

Learning Transferable Skills in Action RPGs via Directed Skill Graphs and Selective Adaptation

通过定向技能图和选择性适应在动作RPG中学习可转移的技能

Ali Najar

机构 * Sharif University of Technology(沙斐大学)

专题命中 规划决策 :agent(abstract,journal_ref);分类 cs.AI

AI总结 本文提出通过定向技能图和选择性适应方法,在动作RPG中实现技能的可转移学习,提高样本效率和适应性。

Comments 5 pages

Journal ref Lifelong Agent Workshop at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10895 2026-03-12 cs.LG 57%

Ergodicity in reinforcement learning

强化学习中的遍历性

Dominik Baumann, Erfaun Noorani, Arsenii Mustafin, Xinyi Sheng, Bert Verbruggen, Arne Vanhoyweghen, Vincent Ginis, Thomas B. Schön

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文探讨了非遍历奖励过程对强化学习的影响,分析了遍历性与马尔可夫链的关系,并提出优化长期性能的方法。

Comments Accepted article to appear in Philosophical Transactions of the Royal Society A: Mathematical, Physical and Engineering Sciences

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10294 2026-03-12 eess.SY cs.AI cs.SY 57%

Simulation-in-the-Reasoning (SiR): A Conceptual Framework for Empirically Grounded AI in Autonomous Transportation

推理中的模拟(SiR):面向自主交通系统经验导向AI的概念框架

Wuping Xin

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 SiR通过将领域模拟器嵌入LLM推理循环,为自主交通系统提供经验导向的AI框架,提升策略验证与优化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10220 2026-03-12 cs.CV cs.AI cs.RO 57%

Robotic Ultrasound Makes CBCT Alive

机器人超声使CBCT活起来

Feng Li, Ziyuan Li, Zhongliang Jiang, Nassir Navab, Yuan Bi

机构 * Chair for Computer-Aided Medical Procedures and Augmented Reality, Technical University of Munich(计算机辅助医学程序与增强现实 chair,慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心) The University of Hong Kong(香港大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 利用机器人超声实现动态CBCT更新,通过实时估计组织变形提升手术导航精度

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10210 2026-03-12 cs.CV cs.AI 57%

Delta-K: Boosting Multi-Instance Generation via Cross-Attention Augmentation

Delta-K: 通过交叉注意力增强提升多实例生成

Zitong Wang, Zijun Shen, Haohao Xu, Zhengjie Luo, Weibin Wu

机构 * School of Software Engineering, Sun Yat-sen University(中山大学软件学院) Nanjing University(南京大学) College of Management and Economics, Tianjin University(天津大学管理学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 Delta-K通过在交叉注意力键空间中直接操作,解决扩散模型在多实例生成中的概念遗漏问题,提升生成质量且无需额外训练或架构修改。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10099 2026-03-12 cs.LG cs.CR 57%

Denoising the US Census: Succinct Block Hierarchical Regression

美国人口普查去噪:简洁的块层次回归

Badih Ghazi, Pritish Kamath, Ravi Kumar, Pasin Manurangsi, Adam Sealfon

机构 * Google Research(谷歌研究)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本研究提出BlueDown方法,通过简洁的层次回归技术提升人口普查数据的准确性与一致性,满足隐私和结构约束,显著改善县和普查区层面的评估指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12566 2026-03-12 cs.AI 57%

To Mix or To Merge: Toward Multi-Domain Reinforcement Learning for Large Language Models

混合还是合并:为大语言模型的多领域强化学习而努力

Haoqing Wang, Xiang Long, Ziheng Li, Yilong Xu, Tingguang Li, Yehui Tang

机构 * Samsung Research(三星研究院) Peking University(北京大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本研究提出M2RL框架,通过混合多任务训练或模型合并策略,提升大语言模型在多领域任务中的推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏