arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-11 至 2026-03-11 共收录 136 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 6 篇

2603.09018 2026-03-11 cs.AI 87%

Meissa: Multi-modal Medical Agentic Intelligence

Meissa:多模态医疗代理智能

Yixiong Chen, Xinyi Bai, Yue Pan, Zongwei Zhou, Alan Yuille

机构 * Johns Hopkins University(约翰霍普金斯大学) Cornell University(康奈尔大学)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);tool use(abstract);multi-agent(abstract)

AI总结 Meissa是一种轻量级多模态医疗代理智能模型,通过离线学习策略选择与执行,实现高效医疗决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01399 2026-03-11 cs.RO 85%

Physics-Conditioned Grasping for Stable Tool Use

基于物理条件的抓取以实现稳定的工具使用

Noah Trupin, Zixing Wang, Ahmed H. Qureshi

机构 * Purdue University(普渡大学)

专题命中 工具调用 :tool use(title,abstract);tool-use(abstract);planning(abstract)

AI总结 本文提出逆向工具使用规划方法,通过最小化预测交互扭矩来实现稳定工具使用,提升了现实世界中的操作成功率。

Comments In submission and under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20009 2026-03-11 eess.SY cs.SY 82%

IMAS$^2$: Joint Agent Selection and Information-Theoretic Coordinated Perception In Dec-POMDPs

IMAS$^2$: 联合选择感知代理与信息论协调感知在Dec-POMDPs中

Chongyang Shi, Wesley A. Suttle, Michael Dorothy, Jie Fu

专题命中 工具调用 :agent(title,abstract);multi-agent(abstract)

AI总结 IMAS$^2$通过信息论度量联合选择感知代理并合成去中心化主动感知策略,在Dec-POMDP框架中提供性能保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08933 2026-03-11 cs.AI cs.IR cs.LG 81%

Interpretable Markov-Based Spatiotemporal Risk Surfaces for Missing-Child Search Planning with Reinforcement Learning and LLM-Based Quality Assurance

可解释的基于马尔可夫的时空风险表面用于缺失儿童搜索规划的强化学习与基于LLM的质量保证

Joshua Castillo, Ravi Mukkamala

机构 * Old Dominion University(老奥尔巴尼大学)

专题命中 工具调用 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 Guardian系统利用马尔可夫链、强化学习和LLM进行可解释的时空风险建模,以提升失踪儿童搜索规划的效率和准确性。

Comments 14 pages, 7 figures. Accepted at ICEIS 2026 (International Conference on Enterprise Information Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09486 2026-03-11 cs.AI 57%

Vibe-Creation: The Epistemology of Human-AI Emergent Cognition

Vibe-Creation:人类与人工智能涌现认知的 epistemology

Ilya Levin

专题命中 工具调用 :tool use(abstract);分类 cs.AI

AI总结 本文提出‘vibe-creation’概念,探讨人类与生成式人工智能交互产生的认知-认识论形成‘第三实体’,并分析其对教育理论和知识能力的深远影响。

Comments 11 pages, 1 fugure

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22560 2026-03-11 cs.GT math.OC 50%

Two-Stage Stochastic Capacity Expansion in Stable Matching under Truthful or Strategic Preference Uncertainty

稳定匹配下的双重随机容量扩展:在真实或战略偏好不确定性下

Maria Bazotte, Margarida Carvalho, Thibaut Vidal

专题命中 工具调用 :planning(abstract)

AI总结 本文提出了一种在真实或战略偏好不确定性下的双重随机容量扩展机制,通过学校选择案例研究,探讨了在容量规划中考虑学生偏好不确定性的方法,并开发了基于行为的启发式算法以优化匹配结果。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 50 篇

2603.02154 2026-03-11 cs.MA cs.AI 92%

Boltzmann-based Exploration for Robust Decentralized Multi-Agent Planning (Extended Version)

基于玻尔兹曼的探索用于鲁棒的去中心化多智能体规划(扩展版)

Nhat D. A. Nguyen, Duong D. Nguyen, Gianluca Rizzo, Hung X. Nguyen

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出CB-MCTS,通过玻尔兹曼策略和熵奖励提升多智能体规划的鲁棒性,在欺骗场景中表现更优。

Comments To appear in ICAPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09188 2026-03-11 cs.RO 91%

Robust Spatiotemporal Motion Planning for Multi-Agent Autonomous Racing via Topological Gap Identification and Accelerated MPC

多智能体自主赛车中鲁棒时空运动规划 via 拓扑间隙识别与加速MPC

Mingyi Zhang, Cheng Hu, Yiqin Wang, Haotong Qin, Hongye Su, Lei Xie

机构 * Department of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院) Center for Project-Based Learning, D-ITET, ETH Zurich(苏黎世联邦理工学院项目导向学习中心)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract)

AI总结 本文提出基于拓扑间隙识别与加速MPC的框架,通过预测对手行为和动态占用走廊,实现高速多智能体自主赛车中鲁棒的时空规划与高精度控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09890 2026-03-11 cs.AI cs.MA 88%

Influencing LLM Multi-Agent Dialogue via Policy-Parameterized Prompts

通过策略参数化提示影响LLM多智能体对话

Hongbo Bo, Jingyu Hu, Weiru Liu

机构 * University of Bristol(布里斯托大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出通过策略参数化提示影响LLM多智能体对话,通过动态构建提示序列影响对话动态,实验验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09843 2026-03-11 cs.IR 87%

RecThinker: An Agentic Framework for Tool-Augmented Reasoning in Recommendation

RecThinker: 一种用于推荐中的工具增强推理的代理框架

Haobo Zhang, Yutao Zhu, Kelong Mao, Tianhao Li, Zhicheng Dou

专题命中 规划决策 :agentic(title,abstract);agent(abstract);tool-use(abstract);planning(abstract)

AI总结 RecThinker通过动态规划和主动工具调用,提升推荐系统中信息获取和推理能力,实现更优的用户-物品匹配。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21735 2026-03-11 cs.SE cs.AI cs.CL cs.MA 87%

GateLens: A Reasoning-Enhanced LLM Agent for Automotive Software Release Analytics

GateLens: 一种增强推理能力的LLM代理用于汽车软件发布分析

Arsham Gholamzadeh Khoee, Shuai Wang, Robert Feldt, Dhasarathy Parthasarathy, Yinan Yu

专题命中 规划决策 :agent(title,abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 GateLens是一种基于LLM的代理,通过引入关系代数作为中间表示,提升复杂表格数据分析的效率与准确性,适用于汽车软件发布分析领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06261 2026-03-11 cs.AI cs.CL cs.LG 87%

AlphaApollo: A System for Deep Agentic Reasoning

AlphaApollo:一个深度代理推理系统

Zhanke Zhou, Chentao Cao, Xiao Feng, Xuan Li, Zongze Li, Xiangyu Lu, Jiangchao Yao, Weikai Huang, Tian Cheng, Jianghangfan Zhang, Tangyu Jiang, Linrui Xu, Yiming Zheng, Brando Miranda, Tongliang Liu, Sanmi Koyejo, Masashi Sugiyama, Bo Han

机构 * TMLR Group Department of Computer Science Hong Kong Baptist University(香港 Baptist 大学计算机科学系 TMLR 组) RIKEN AIP Cooperative Medianet Innovation Center Shanghai Jiao Tong University(上海交通大学合作中立创新中心) Stanford University(斯坦福大学) Sydney AI Centre The University of Sydney(悉尼大学悉尼AI中心) The University of Tokyo(东京大学)

专题命中 规划决策 :agentic(title,abstract);tool use(abstract);tool-use(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 AlphaApollo通过多轮代理推理、学习和进化机制,提升基础模型在复杂问题解决中的推理能力和工具使用可靠性。

Comments Ongoing project

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08736 2026-03-11 cs.DC cs.AI cs.LG cs.SY eess.SY 86%

Autonomous Edge-Deployed AI Agents for Electric Vehicle Charging Infrastructure Management

自主边缘部署AI代理用于电动汽车充电基础设施管理

Mohammed Cherifi

机构 * Hyperion Consulting(超离子咨询)

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Auralink SDC架构,通过边缘部署的专用AI代理实现电动汽车充电基础设施的自主管理,实现高准确率的事故修复与快速响应。

Comments 27 pages, 10 figures (TikZ), 27 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08814 2026-03-11 cs.RO cs.AI cs.ET cs.MA 85%

Scale-Plan: Scalable Language-Enabled Task Planning for Heterogeneous Multi-Robot Teams

Scale-Plan: 为异构多机器人团队实现可扩展的语言赋能任务规划

Piyush Gupta, Sangjae Bae, Jiachen Li, David Isele

机构 * Honda Research Institute(本田研究院) University of California(加州大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 Scale-Plan通过生成紧凑的任务相关问题表示,提升异构多机器人团队的可扩展性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07528 2026-03-11 cs.CL 83%

TableMind++: An Uncertainty-Aware Programmatic Agent for Tool-Augmented Table Reasoning

TableMind++: 一种面向工具增强表格推理的不确定性感知程序化代理

Mingyue Cheng, Shuo Yu, Chuang Jiang, Xiaoyu Tao, Qingyang Mao, Jie Ouyang, Qi Liu, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.CL

AI总结 TableMind++通过引入不确定性感知推理框架,有效缓解LLM的幻觉问题,提升表格推理的准确性和鲁棒性。

Comments 6 tables, 9 figures. arXiv admin note: text overlap with arXiv:2509.06278

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09049 2026-03-11 cs.AI 83%

EPOCH: An Agentic Protocol for Multi-Round System Optimization

EPOCH:多轮系统优化的代理协议

Zhanlin Liu, Yitao Li, Munirathnam Srikanth

专题命中 规划决策 :agentic(title);autonomous agent(abstract);planning(abstract);分类 cs.AI

AI总结 EPOCH是一种用于多轮系统优化的代理协议,通过分阶段的结构化流程实现协调优化,提升自主改进工作的稳定性和可追溯性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09036 2026-03-11 cs.LG 81%

SCALAR: Learning and Composing Skills through LLM Guided Symbolic Planning and Deep RL Grounding

SCALAR:通过LLM引导的符号规划和深度RL接地学习与组合技能

Renos Zabounidis, Yue Wu, Simon Stepputtis, Woojun Kim, Yuanzhi Li, Tom Mitchell, Katia Sycara

专题命中 规划决策 :planning(title,abstract);分类 cs.LG;agent(comments)

AI总结 SCALAR通过结合LLM引导的符号规划与深度RL,实现技能学习与组合,显著提升任务完成效率和鲁棒性。

Comments Best Paper Award Honorable Mention at NeurIPS 2025 Workshop on Bridging Language, Agent, and World Models for Reasoning and Planning

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24235 2026-03-11 cs.RO cs.AI 79%

SafeGen-LLM: Enhancing Safety Generalization in Task Planning for Robotic Systems

SafeGen-LLM: 提高机器人系统任务规划中的安全性泛化能力

Jialiang Fan, Weizhe Xu, Mengyu Liu, Oleg Sokolsky, Insup Lee, Fanxin Kong

机构 * University of Notre Dame(诺丁汉大学) Washington State University(华盛顿州立大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 SafeGen-LLM通过两阶段框架提升机器人任务规划的安全性泛化能力,优于现有基线。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04626 2026-03-11 stat.ML cs.LG 79%

Regret-Optimal Q-Learning with Low Cost for Single-Agent and Federated Reinforcement Learning

降低单智能体和联邦强化学习成本的最优遗憾Q学习

Haochen Zhang, Zhong Zheng, Lingzhou Xue

专题命中 规划决策 :agent(title,abstract);分类 cs.LG

AI总结 本文提出两种新型算法,实现单智能体和联邦强化学习中最优遗憾、低烧入成本及对数级策略切换或通信成本。

Comments arXiv admin note: text overlap with arXiv:2502.02859

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09184 2026-03-11 cs.LG cs.AI 79%

Latent-DARM: Bridging Discrete Diffusion And Autoregressive Models For Reasoning

Latent-DARM: 联结离散扩散与自回归模型以实现推理

Lina Berrayana, Ahmed Heakl, Abdullah Sohail, Thomas Hofmann, Salman Khan, Wei Chen

机构 * EPFL(苏黎世联邦理工学院) MBZUAI(马克斯·普朗克人工智能研究所) ETH Zürich(苏黎世联邦理工学院) Microsoft Research Asia(微软亚洲研究院)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 Latent-DARM通过结合离散扩散模型与自回归模型,提升多智能体系统在推理任务中的表现和协作效率。

Comments Published at LIT Workshop at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09743 2026-03-11 cs.CV 78%

LAP: A Language-Aware Planning Model For Procedure Planning In Instructional Videos

LAP:一种语言感知的规划模型用于教学视频中的过程规划

Lei Shi, Victor Aregbede, Andreas Persson, Martin Längkvist, Amy Loutfi, Stephanie Lowry

机构 * Örebro University(奥雷布罗大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 LAP通过利用语言描述提升过程规划的准确性,实现教学视频中动作序列的高效生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21074 2026-03-11 cs.RO 78%

Revisiting Replanning from Scratch: Real-Time Incremental Planning with Fast Almost-Surely Asymptotically Optimal Planners

重新审视从零开始的重规划:使用快速几乎肯定渐近最优规划器的实时增量规划

Mitchell E. C. Sabbadini, Andrew H. Liu, Joseph Ruan, Tyler S. Wilson, Zachary Kingston, Jonathan D. Gammell

机构 * Estimation, Search, and Planning (ESP) Research Group, Queen’s University(估计、搜索与规划研究组,女王大学) CoMMA Lab, Department of Computer Science, Purdue University(CoMMA实验室,计算机科学系,普渡大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出使用快速几乎肯定渐近最优规划算法,通过模拟实验展示了其在实时增量规划中的有效性,能够有效应对变化障碍物环境。

Comments IEEE International Conference on Robotics and Automation (ICRA) 2026, 8 pages, 5 figures, 1 table. A video of this work can be found at https://www.youtube.com/watch?v=XaZrFy8wGZs

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11361 2026-03-11 econ.GN q-fin.EC 78%

Adaptive Robust Optimization for European Electricity System Planning Considering Regional Dunkelflaute Events

适应性稳健优化用于考虑区域黑暗无风事件的欧洲电力系统规划

Maximilian Bernecker, Smaranda Sgarciu, Xiaoming Kan, Mehrnaz Anvari, Iegor Riepin, Felix Müsgens

专题命中 规划决策 :planning(title,abstract)

AI总结 本研究通过适应性稳健优化方法,分析了区域黑暗无风事件对欧洲电力系统规划的影响,发现系统成本随事件地理范围扩大非线性上升,需协调政策以提升系统韧性。

Comments Code and data can be found on github: https://github.com/bernemax/ARO_Dunkelflaute_Europe

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09031 2026-03-11 cs.RO 78%

ImpedanceDiffusion: Diffusion-Based Global Path Planning for UAV Swarm Navigation with Generative Impedance Control

阻抗扩散:基于扩散的全局路径规划用于无人机群导航的生成阻抗控制

Faryal Batool, Yasheerah Yaqoot, Muhammad Ahsan Mustafa, Roohan Ahmed Khan, Aleksey Fedoseev, Dzmitry Tsetserukou

机构 * Intelligent Space Robotics Laboratory, Center for Digital Engineering, Skolkovo Institute of Science and Technology(智能空间机器人实验室,数字工程中心,斯克尔科夫科学与技术研究所)

专题命中 规划决策 :planning(title,abstract)

AI总结 ImpedanceDiffusion通过结合扩散模型和人工势场跟踪,实现无人机群在复杂环境中的可靠路径规划与自适应阻抗控制。

Comments This is paper is under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08988 2026-03-11 cs.RO 78%

Characterization, Analytical Planning, and Hybrid Force Control for the Inspire RH56DFX Hand

Inspire RH56DFX手的表征、分析规划与混合力控

Xuan Tan, William Xie, Nikolaus Correll

机构 * Department of Computer Science, University of Colorado Boulder(计算机科学系,科罗拉多大学博尔德分校)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文通过硬件表征、MuJoCo模型和混合力控方法改进Inspire RH56DFX手,提升其在抓取任务中的性能和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09337 2026-03-11 cs.CV cs.AI 77%

Beyond Scaling: Assessing Strategic Reasoning and Rapid Decision-Making Capability of LLMs in Zero-sum Environments

超越规模:在零和环境中评估大语言模型的战略推理和快速决策能力

Yang Li, Xing Chen, Yutao Liu, Gege Qi, Yanxian BI, Zizhe Wang, Yunjian Zhang, Yao Zhu

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出STAR基准,评估大语言模型在零和环境中的战略推理和快速决策能力,揭示推理深度与及时行动能力的权衡。

Comments Code available

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09756 2026-03-11 cs.DB 75%

Epistemic Closure: Autonomous Mechanism Completion for Physically Consistent Simulation

认知闭合:用于物理一致模拟的自主机制完成

Yue Wua, Tianhao Su, Rui Hu, Mingchuan Zhao, Shunbo Hu, Deng Pan, Jizhong Huang

专题命中 规划决策 :agent(abstract);AI agent(abstract);workflow(abstract)

AI总结 本文提出神经符号生成代理,通过自主验证和完成物理机制,解决科学模拟中的物理幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09641 2026-03-11 cs.AI cs.IR 74%

PRECEPT: Planning Resilience via Experience, Context Engineering & Probing Trajectories A Unified Framework for Test-Time Adaptation with Compositional Rule Learning and Pareto-Guided Prompt Evolution

PRECEPT:通过经验、上下文工程与轨迹探测进行规划韧性 一个具有组合规则学习和帕累托引导提示演化的测试时间适应统一框架

Arash Shahmansoori

专题命中 规划决策 :planning(title);分类 cs.AI

AI总结 PRECEPT通过经验、上下文工程与轨迹探测,结合组合规则学习和帕累托引导提示演化,提升测试时间适应的鲁棒性和泛化能力。

Comments 50 pages, 14 figures. Code and reproducibility resources: https://github.com/arash-shahmansoori/precept-framework

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17102 2026-03-11 cs.AI 74%

Reinforcement Learning for Self-Improving Agent with Skill Library

基于技能库的自我改进智能体强化学习

Jiongxiao Wang, Qiaojing Yan, Yawei Wang, Yijun Tian, Soumya Smruti Mishra, Zhichao Xu, Megha Gandhi, Panpan Xu, Lin Lee Cheong

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) AWS Agentic AI(AWS智能代理)

专题命中 规划决策 :agent(title);分类 cs.AI

AI总结 本文提出SAGE框架,通过强化学习结合技能库,提升智能体在新环境中的自我改进能力,实验显示其在准确性和效率上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18615 2026-03-11 cs.RO cs.LG 74%

A Distributional Treatment of Real2Sim2Real for Object-Centric Agent Adaptation in Vision-Driven Deformable Linear Object Manipulation

基于分布的实-仿-实方法用于视觉驱动的可变形线性物体操控中的对象中心智能体适应

Georgios Kamaras, Subramanian Ramamoorthy

机构 * School of Informatics, The University of Edinburgh(信息学院,爱丁堡大学)

专题命中 规划决策 :agent(title);分类 cs.LG

AI总结 本文提出基于分布的实-仿-实方法,通过视觉感知操控可变形线性物体,利用无需模型推断进行域随机化训练,实现无微调的现实应用。

Journal ref In IEEE Robotics and Automation Letters, Volume 10, Issue 8, August 2025, Pages 8075-8082

详情

展开后加载摘要…

URL PDF HTML 收藏