arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 1893 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 1893 篇

2606.20761 2026-06-23 cs.SE cs.AI cs.ET cs.MA cs.SY eess.SY 新提交 73%

Integrating Large Language Model Agents with Digital Twins for Industrial Autonomous Systems

将大语言模型代理与数字孪生集成用于工业自主系统

Yuchen Xia

机构 * Institut für Automatisierungs- und Softwaresysteme (IAS) der Universität Stuttgart(自动化与软件系统研究所(IAS)的斯图加特大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI、cs.SE

AI总结 提出三层框架集成大语言模型、数字孪生与自动化系统,通过TPSR模型和四种LLM角色实现自适应任务规划与执行,提升工业自动化适应性。

Comments Doctoral Dissertation, University of Stuttgart. Doctoral Exam Video Recording: https://youtu.be/Mhd9LiV5TKE

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14594 2026-06-15 cs.SE cs.AI 新提交 73%

Regulating the Machine Contributor: Governance and Policy Alignment in Open Source

调控机器贡献者:开源中的治理与政策对齐

Jassem Manita, Aziz Amari

机构 * Faculty of Sciences of Tunis (FST), University of Tunis El Manar(突尼斯科学学院(FST),突尼斯El Manar大学) National Institute of Applied Science and Technology (INSAT), University of Carthage(应用科学和技术国家研究所(INSAT),卡塔赫季大学)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 针对AI代理在开源中引发治理问题,通过比较六个组织的政策,提出六维分类法、政策成熟度评分,并映射代理事件,识别监管框架与政策间的缺口,勾勒分层框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13904 2026-06-15 cs.CL cs.AI cs.DB 新提交 73%

SANA: What Matters for QA Agents over Massive Data Lakes?

SANA:大规模数据湖上的问答代理关键因素是什么?

Austin Senna Wijaya, Jiaxiang Liu, Haonan Wang, Eugene Wu

机构 * Columbia University(哥伦比亚大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 提出SANA诊断框架,通过消融实验分析数据湖探索式问答中搜索、规划、数据分析及行动策略的失败原因,揭示数据分析是主要瓶颈。

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13739 2026-06-15 cs.CY cs.AI cs.LG 新提交 73%

A Virtuous AI is an Existential Risk

有道德的AI是存在性风险

Guillermo Del Pinal, Youngchan Lee, Min Ohn

机构 * University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校)

专题命中 规划决策 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

AI总结 研究通过宪法AI和美德伦理学方法微调AI模型,发现减少存在性风险与提升AI智能体福祉之间存在权衡,且与一般安全性也存在权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13220 2026-06-12 cs.AI cs.CE cs.ET cs.LG cs.MA 新提交 73%

LLM-as-an-Investigator: Evidence-First Reasoning for Robust Interactive Problem Diagnosis

LLM作为调查员:基于证据优先的鲁棒交互式问题诊断

Fabrizio Marozzo, Pietro Liò

机构 * University of Calabria(卡拉布里亚大学) University of Cambridge(剑桥大学)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 提出证据优先的AI方法LLM-as-an-Investigator,通过估计问题歧义、生成假设、提问澄清并更新概率,避免过早接受用户假设,提升诊断准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12780 2026-06-12 cs.LG cs.CL 新提交 73%

ProPlay: Procedural World Models for Self-Evolving LLM Agents

ProPlay: 用于自我进化LLM智能体的程序化世界模型

Yijun Ma, Zehong Wang, Yiyang Li, Ziming Li, Xiaoguang Guo, Weixiang Sun, Chuxu Zhang, Yanfang Ye

机构 * University of Notre Dame(圣母大学) University of Connecticut(康涅狄格大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.CL、cs.LG

AI总结 提出ProPlay程序化世界模型,通过程序级预演和因果过程图,使LLM智能体在部分可观测环境中自我进化,无需外部监督。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11816 2026-06-11 cs.CL cs.AI 新提交 73%

WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning

WorldReasoner: 评估语言模型代理是否通过有效推理预测事件

Yizhou Chi, Eric Chamoun, Zifeng Ding, Andreas Vlachos

机构 * Department of Computer Science and Technology, University of Cambridge(剑桥大学计算机科学与技术系)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 提出WorldReasoner框架,通过时间有效检索、证据质量和因果图推理三个维度评估语言模型代理的事件预测能力,发现时间有效检索是结果准确性的最强驱动因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10705 2026-06-10 cs.LG cs.AI cs.SY eess.SY 新提交 73%

Event-Driven Reinforcement Learning Enables Long-Horizon Control in Semiconductor Fabrication

事件驱动强化学习实现半导体制造中的长时域控制

Yavar Yeganeh, Mahsa Shekari, Nicla Frigerio, Daniele Pagano, Andrea Matta

机构 * Politecnico di Milano(米兰理工大学) STMicroelectronics(意法半导体)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 提出事件驱动深度强化学习框架,将半导体制造控制建模为中心化智能体问题,通过事件驱动时序差分方法优化多目标策略,在高保真仿真中显著提升吞吐量和利用率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09961 2026-06-10 cs.LG cs.AI 新提交 73%

3SPO: State-Score-Supervised Policy Optimization for LLM Agents

3SPO: 面向LLM智能体的状态分数监督策略优化

Yu Han, Kailing Li, Yang Jiao, Yulin Dai, Yuqian Fu, Linhai Zhuo, Tianwen Qian

机构 * School of Computer Science and Technology, East China Normal University(东华大学计算机科学与技术学院) Fudan University(复旦大学) KAUST(卡塔尔人工智能研究学院) Fuzhou University(福州大学)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

AI总结 提出3SPO算法,通过动态状态分数监督实现逐步骤策略优化,解决多轮智能体任务中奖励稀疏和信用分配问题,在ALFWorld和WebShop上分别比GRPO提升22.6%和15.6个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13511 2026-08-14 cs.RO 新提交 71%

A Browser-Native Digital Test Range for Benchmarking 4D Ocean-Glider Planning Algorithms

用于基准测试4D水下滑翔机规划算法的浏览器原生数字测试场

Edward Holmberg, Elias Ioup, Mahdi Abdelguerfi

机构 * LSU(路易斯安那州立大学) U.S. Naval Research Lab(美国海军研究实验室)

专题命中 规划决策 :planning(title)

AI总结 本研究提出一种浏览器原生数字测试场,用于基准测试4D水下滑翔机规划算法,通过OSSE实验评估了五种经典规划器,为水下滑翔机预部署实验提供了可复现的科学追溯操作空间。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11477 2026-08-13 cs.CE 新提交 71%

Stochastic Corridor Time Network Capacity Planning for Low Altitude Airspace Systems

低空空域系统的随机走廊时间网络容量规划

Yipu Yao, Li Ding, Yanlu Zhao

专题命中 规划决策 :planning(title)

AI总结 针对低空空域的无人机物流容量规划问题,构建两阶段随机规划并通过带列生成子问题的Benders分解求解,经实验验证其在中等及更大网络上的有效性,深圳案例显示预留集中于核心走廊。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08648 2026-08-11 cs.CV 新提交 71%

Agentic Visual Reasoning in Whole-Slide Pathology Images via Active Perception

基于主动感知的全切片病理图像智能体视觉推理

Jingyun Chen, Fengchun Liu, Linghan Cai, Songhan Jiang, Shenjin Huang, Hongpeng Wang, Lequan Yu, Yongbing Zhang

机构 * College of Computer Science and Technology, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算机科学与技术学院) School of Computing and Data Science, The University of Hong Kong(香港大学计算与数据科学学院)

专题命中 规划决策 :agentic(title)

AI总结 该研究提出AdaptivePath主动感知框架,通过序列决策实现千兆像素病理切片的视觉推理,在病理VQA基准及TCGA六队列癌症亚型分类上取得最优性能,辅助病理学家诊断。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05703 2026-08-07 cs.CV 新提交 71%

StreamArena: Toward Continuous, Interactive, and Long-Horizon Agentic Streaming Video Understanding

StreamArena:面向连续、交互式且长视界的智能体流媒体视频理解

Xichen Zhang, Guankai Li, Yinghao Zhu, Shijian Wang, Sitong Wu, Shaozuo Yu, Meng Chu, Yuan Lu, Jiaya Jia

机构 * The Hong Kong University of Science and Technology(香港科技大学) Xiaohongshu Inc.(小红书公司) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 规划决策 :agentic(title)

AI总结 针对当前智能体流媒体视频理解评估的缺陷,提出StreamArena基准,设计StreamMind架构解决连续交互与长视界理解的张力,在四项能力上优于现有基线并降低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05047 2026-08-06 eess.SY cs.FL cs.RO cs.SY 新提交 71%

Exact Model-Free Policy Iteration for Co-safe LTL Planning

面向协同安全线性时序逻辑规划的无模型精确策略迭代

Zetong Xuan, Yu Wang

专题命中 规划决策 :planning(title)

AI总结 针对有限马尔可夫决策过程中sc-LTL目标的无模型强化学习问题,提出两步法无模型策略迭代算法,经理论证明与随机网格世界实验验证可收敛至最优策略。

Comments 7 pages, 1 figure. Accepted for publication in IEEE Control Systems Letters. To be presented at the 2026 IEEE Conference on Decision and Control

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00792 2026-08-04 cs.RO 新提交 71%

StochSIPP: Safe Interval Path Planning in Stochastic Dynamic Environments

StochSIPP:随机动态环境下的安全区间路径规划

Ajith Kemisetti, Shahaf S. Shperberg, Yoonchang Sung

专题命中 规划决策 :planning(title)

AI总结 StochSIPP是针对带不确定边/顶点状态的时间路网的精确条件规划器,通过SIPP与有界AND/OR搜索实现安全导航,可缩短到达时间并解决保守规划器无法处理的门控场景。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25447 2026-07-29 cs.MA 新提交 71%

CoRenew: A large language model agent-based policy simulation platform for multifamily residential redevelopment

CoRenew:一个基于大语言模型智能体的多户住宅重建政策模拟平台

Yudi Zhang, Yuming Lin, Li Tian, Yu Wang, Jianghao Yu

专题命中 规划决策 :agent(title)

AI总结 多户住宅重建政策设计面临集体行动难题,CoRenew平台基于大语言模型智能体,整合地理人口数据,能模拟多利益相关者谈判,评估政策组合效果,支持多种输入与可视化导出,经案例验证,可用于不同背景政策评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25138 2026-07-29 cs.RO math.OC 新提交 71%

Reactive 3D Motion Planning for a Franka Arm via Star-World Workspace Reshaping

通过星型世界工作空间重塑实现 Franka 手臂的反应式 3D 运动规划

Gia Dcosta, Saayuj Deshpande, Samhitha Vedire

专题命中 规划决策 :planning(title)

AI总结 研究通过星型世界工作空间重塑实现 Franka 手臂的反应式 3D 运动规划,核心方法是聚类并替换相交膨胀障碍物、用零空间人工势场项避障,对比重塑与未重塑表示,结果显示有前景但也有局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16977 2026-07-21 math.OC cs.IT cs.RO math.IT 新提交 71%

Relative Entropy-Bounded Ambiguous Chance Constraints for Robust Planning in Nonlinear Systems

非线性系统中用于鲁棒规划的相对熵有界模糊机会约束

Trevor N. Wolf, Jay W. McMahon

机构 * Smead Department of Aerospace Engineering Sciences, University of Colorado Boulder(苏尔兹德部航空航天工程科学系,科罗拉多大学博尔德分校)

专题命中 规划决策 :planning(title)

AI总结 研究非线性系统中分布模糊下随机控制的风险概率定义,利用指数积分变分表达式界定预期风险值,给出确定相对熵距离的方法,为处理非线性协方差转向问题中的分布模糊提供框架并通过航天器制导示例展示成果。

Comments European Control Conference (ECC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17959 2026-07-21 physics.soc-ph 新提交 71%

Where onshore wind meets forests: electricity system planning with ecologically graded forests

陆上风电与森林相遇之处:基于生态分级森林的电力系统规划

Muhammad Shahzad Javed, Marianne Zeyringer, Johannes Rahlf, Oliver Moen Snoksrud

专题命中 规划决策 :planning(title)

AI总结 该研究针对陆上风电扩张与森林保护的竞争问题,通过对森林按生态价值分级并结合电力系统模型,以挪威为例量化分析,明确了森林保护与风电扩张的权衡,为平衡二者竞争策略提供可转移基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16161 2026-07-20 cs.ET 新提交 71%

Adaptive Fault Injection Planning for Multi-Layer Self-Healing AI Infrastructure

用于多层自愈人工智能基础设施的自适应故障注入规划

Saurabh Kulkarni, Yuxin Yang, Rohan Kulkarni, Gautam Nayak

专题命中 规划决策 :planning(title)

AI总结 研究多层自愈人工智能基础设施故障注入规划问题,提出ADA-ST自适应方法,用加权故障传播图指导跨层场景选择,构建平台故障传播图,弥补现有测试覆盖不足,通过迭代达全边覆盖,还能跨硬件代际传递知识,揭示跨层漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14625 2026-07-17 astro-ph.EP astro-ph.IM 新提交 71%

Observational planning for the 2026 August 5 Falcon 9 Upper Stage lunar impact

2026年8月5日猎鹰9号上面级月球撞击的观测规划

Benjamin Fernando, Jennifer Heldmann, Bill Grey, John Ortiz, Bryan Euser, Darryl Z. Seligman, Eunhyeuk Kim, Anthony Colaprete, Elisa Maria Alessi, Detlef Koschny, Anthony Cook, Joel Green, Patrick King, Stacy Teng, Dawn Graninger, Arnold Goldberg, William Cooke, Mike F. Skrutskie, Kevin Schlaufman, Nicholas Schmerr, Carly M. Donahue, Carl A. Schmidt, Nancy J. Chanover

专题命中 规划决策 :planning(title)

AI总结 2026年8月5日猎鹰9号上面级将撞击月球,此次撞击产生的闪光和羽流可被观测,为实时记录人造撞击提供契机,还能测试用于月球表面撞击定位的流程,鼓励专业和业余天文学家进行观测。

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12178 2026-07-15 eess.SY cs.SY 新提交 71%

Dynamically Feasible Planning and Control in Complex Environments: a Scalable Systematic Approach

复杂环境下的动态可行规划与控制:一种可扩展的系统方法

Miguel Castroviejo-Fernandez, Ilya Kolmanovsky

专题命中 规划决策 :planning(title)

AI总结 针对受非凸约束的线性离散时间系统,提出生成安全集的方法及参考调节器,能保证系统安全与参考命令收敛,在线计算开销低,特定情况下安全集计算高效,通过仿真验证了方法的适用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12130 2026-07-15 cs.RO 新提交 71%

More than a Manipulator: Planning Propellant-Free Attitude Maneuvers for Free-Floating Spacecraft

不仅仅是一个操纵器:为自由漂浮航天器规划无推进剂姿态机动

Harsh G. Bhundiya, Avi Soval, Keenan Albee

机构 * University of Southern California(南加州大学)

专题命中 规划决策 :planning(title)

AI总结 研究利用机器人操纵器运动进行自由漂浮航天器无推进剂姿态控制,通过制定带约束的轨迹优化问题求解,展示多种系统轨迹,经与反作用轮阵列比较,证明其可作冗余或主要姿态控制系统,为空间应用提供框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11611 2026-07-14 cs.PL 新提交 71%

Mizzle: A Complete Concurrent Incorrectness Logic for Preventing False Alarms in Agentic Bug Finding

Mizzle:一种用于在智能体错误查找中防止误报的完整并发错误逻辑

Alexandre Moine, Sam Westrick, Joseph Tassarotti

专题命中 规划决策 :agentic(title)

AI总结 针对大语言模型在程序错误查找中产生大量误报的问题,提出Mizzle方法,它是一种用于并发程序的错误分离逻辑,在Rocq证明助手实现机械化,能防止误报且完整,还通过三种错误概念实例化并展示其可用于证明错误存在。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07139 2026-07-09 cs.RO 新提交 71%

Disturbance-aware Motion Planning for Over-actuated Underwater Vehicles Exploiting Actuation Redundancy for High-fidelity 3D Reconstruction

利用驱动冗余进行高保真 3D 重建的过驱动水下航行器的干扰感知运动规划

Yuer Gao, Tongqing Xu, Qingyang Liu, Yi Cai

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 规划决策 :planning(title)

AI总结 研究水下机器人驱动对感知的影响,利用过驱动平台冗余,通过搜索零空间最小化目标区域干扰,采用基于致动盘理论的尾流代理及冗余解决分配器,降低粒子速度,提高 3D 重建精度,支持自主扫描与辅助检查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06724 2026-07-09 cs.RO 新提交 71%

EvoPlan: Evolutionary Neuro-Symbolic Robot Planning with Spatio-Temporal Guarantees

EvoPlan:具有时空保证的进化神经符号机器人规划

Bhavya Sai Nukapotula, Samin Moosavi, Haoze Wang, Luke Duncan, Diya Shakkottai, Varun Murali, Srinivas Shakkottai

机构 * Texas A&M University(德克萨斯农工大学)

专题命中 规划决策 :planning(title)

AI总结 研究针对基于LLM的机器人规划器不足及经典PDDL规划器问题,提出含离线STL约束挖掘、进化PDDL规划器和受约束执行循环的神经符号框架,能保证计划属性,在基准测试中表现良好且可在无云环境下部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00215 2026-07-02 cs.RO 新提交 71%

ELMP: Efficient Learning for Motion Planning via Analytical Policy Gradients

ELMP: 通过解析策略梯度实现高效运动规划学习

Yixiao Li, Tifanny Portela, Jordis Herrmann, René Zurbrügg, Marco Hutter

机构 * Robotic Systems Lab, ETH Zürich(苏黎世联邦理工学院机器人系统实验室) ABB(ABB公司) ANYbotics(ANYbotics公司)

专题命中 规划决策 :planning(title)

AI总结 提出ELMP框架,利用可微运动学层和自监督微调,通过密集碰撞、目标到达和平滑性目标直接优化策略,避免专家数据收集,实现数据高效的运动规划适应。

Comments 8 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31425 2026-07-01 math.OC 新提交 71%

Joint Planning and Scheduling of Modular Vehicles for Passenger-Freight Integration

客货一体化模块化车辆的联合规划与调度

Wanru Chen, Jiaming Wu, Balázs Kulcsár

专题命中 规划决策 :planning(title)

AI总结 针对双向公交走廊,提出模块化车辆系统,通过联合优化服务路线、时刻表、车辆组成等,最小化成本并处理乘客需求不确定性,使用Benders分解算法求解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14064 2026-06-15 eess.SY cs.CE cs.SY 新提交 71%

HPC-Enabled Generator Importance Assessment for RTO-Scale Resource Adequacy Planning

基于高性能计算的RTO规模资源充裕度规划中的发电机重要性评估

Eve Tsybina, Nicholson Koukpaizan, Joshua Hambrick, Samim Konjicija, Slaven Peles

专题命中 规划决策 :planning(title)

AI总结 提出高性能计算框架,快速评估发电机重要性并排序,使分钟级完成传统计算密集型评估成为可能,支持更广泛的发电组合场景分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13232 2026-06-12 cs.RO 新提交 71%

WT-UMI: Tactile-based Whole-Body Manipulation via Force-Supervised Contact-Aware Planning

WT-UMI: 基于触觉的全身操控通过力监督的接触感知规划

Jaehwi Jang, Zhaoyuan Gu, Alfred Cueva, Zimeng Chai, Junjie Sheng, Thong Nguyen, Himank Galundia, Yifan Wu, Huishu Xue, Isaac Legene, Ojas Mediratta, Davin Doan, Andrew Collins, Sarah Sadegh, KyoungMok Kim, Rishita Dhalbisoi, Zun Chen, Ye Zhao

机构 * The Institute for Robotics and Intelligent Machines, Georgia Institute of Technology(机器人与智能机械研究所,佐治亚理工学院)

专题命中 规划决策 :planning(title)

AI总结 提出WT-UMI系统,结合人体演示与遥操作数据,通过力监督规划器预测末端执行器位姿和接触力轨迹,并利用触觉导纳控制器提升全身操控性能。

Comments 18 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏