arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 6571 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 1893 篇

2606.09961 2026-06-10 cs.LG cs.AI 新提交 73%

3SPO: State-Score-Supervised Policy Optimization for LLM Agents

3SPO: 面向LLM智能体的状态分数监督策略优化

Yu Han, Kailing Li, Yang Jiao, Yulin Dai, Yuqian Fu, Linhai Zhuo, Tianwen Qian

机构 * School of Computer Science and Technology, East China Normal University(东华大学计算机科学与技术学院) Fudan University(复旦大学) KAUST(卡塔尔人工智能研究学院) Fuzhou University(福州大学)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

AI总结 提出3SPO算法,通过动态状态分数监督实现逐步骤策略优化,解决多轮智能体任务中奖励稀疏和信用分配问题,在ALFWorld和WebShop上分别比GRPO提升22.6%和15.6个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13511 2026-08-14 cs.RO 新提交 71%

A Browser-Native Digital Test Range for Benchmarking 4D Ocean-Glider Planning Algorithms

用于基准测试4D水下滑翔机规划算法的浏览器原生数字测试场

Edward Holmberg, Elias Ioup, Mahdi Abdelguerfi

机构 * LSU(路易斯安那州立大学) U.S. Naval Research Lab(美国海军研究实验室)

专题命中 规划决策 :planning(title)

AI总结 本研究提出一种浏览器原生数字测试场,用于基准测试4D水下滑翔机规划算法,通过OSSE实验评估了五种经典规划器,为水下滑翔机预部署实验提供了可复现的科学追溯操作空间。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11477 2026-08-13 cs.CE 新提交 71%

Stochastic Corridor Time Network Capacity Planning for Low Altitude Airspace Systems

低空空域系统的随机走廊时间网络容量规划

Yipu Yao, Li Ding, Yanlu Zhao

专题命中 规划决策 :planning(title)

AI总结 针对低空空域的无人机物流容量规划问题,构建两阶段随机规划并通过带列生成子问题的Benders分解求解,经实验验证其在中等及更大网络上的有效性,深圳案例显示预留集中于核心走廊。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08648 2026-08-11 cs.CV 新提交 71%

Agentic Visual Reasoning in Whole-Slide Pathology Images via Active Perception

基于主动感知的全切片病理图像智能体视觉推理

Jingyun Chen, Fengchun Liu, Linghan Cai, Songhan Jiang, Shenjin Huang, Hongpeng Wang, Lequan Yu, Yongbing Zhang

机构 * College of Computer Science and Technology, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算机科学与技术学院) School of Computing and Data Science, The University of Hong Kong(香港大学计算与数据科学学院)

专题命中 规划决策 :agentic(title)

AI总结 该研究提出AdaptivePath主动感知框架,通过序列决策实现千兆像素病理切片的视觉推理,在病理VQA基准及TCGA六队列癌症亚型分类上取得最优性能,辅助病理学家诊断。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05703 2026-08-07 cs.CV 新提交 71%

StreamArena: Toward Continuous, Interactive, and Long-Horizon Agentic Streaming Video Understanding

StreamArena:面向连续、交互式且长视界的智能体流媒体视频理解

Xichen Zhang, Guankai Li, Yinghao Zhu, Shijian Wang, Sitong Wu, Shaozuo Yu, Meng Chu, Yuan Lu, Jiaya Jia

机构 * The Hong Kong University of Science and Technology(香港科技大学) Xiaohongshu Inc.(小红书公司) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 规划决策 :agentic(title)

AI总结 针对当前智能体流媒体视频理解评估的缺陷,提出StreamArena基准,设计StreamMind架构解决连续交互与长视界理解的张力,在四项能力上优于现有基线并降低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05047 2026-08-06 eess.SY cs.FL cs.RO cs.SY 新提交 71%

Exact Model-Free Policy Iteration for Co-safe LTL Planning

面向协同安全线性时序逻辑规划的无模型精确策略迭代

Zetong Xuan, Yu Wang

专题命中 规划决策 :planning(title)

AI总结 针对有限马尔可夫决策过程中sc-LTL目标的无模型强化学习问题,提出两步法无模型策略迭代算法,经理论证明与随机网格世界实验验证可收敛至最优策略。

Comments 7 pages, 1 figure. Accepted for publication in IEEE Control Systems Letters. To be presented at the 2026 IEEE Conference on Decision and Control

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00792 2026-08-04 cs.RO 新提交 71%

StochSIPP: Safe Interval Path Planning in Stochastic Dynamic Environments

StochSIPP:随机动态环境下的安全区间路径规划

Ajith Kemisetti, Shahaf S. Shperberg, Yoonchang Sung

专题命中 规划决策 :planning(title)

AI总结 StochSIPP是针对带不确定边/顶点状态的时间路网的精确条件规划器,通过SIPP与有界AND/OR搜索实现安全导航,可缩短到达时间并解决保守规划器无法处理的门控场景。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25447 2026-07-29 cs.MA 新提交 71%

CoRenew: A large language model agent-based policy simulation platform for multifamily residential redevelopment

CoRenew:一个基于大语言模型智能体的多户住宅重建政策模拟平台

Yudi Zhang, Yuming Lin, Li Tian, Yu Wang, Jianghao Yu

专题命中 规划决策 :agent(title)

AI总结 多户住宅重建政策设计面临集体行动难题,CoRenew平台基于大语言模型智能体,整合地理人口数据,能模拟多利益相关者谈判,评估政策组合效果,支持多种输入与可视化导出,经案例验证,可用于不同背景政策评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25138 2026-07-29 cs.RO math.OC 新提交 71%

Reactive 3D Motion Planning for a Franka Arm via Star-World Workspace Reshaping

通过星型世界工作空间重塑实现 Franka 手臂的反应式 3D 运动规划

Gia Dcosta, Saayuj Deshpande, Samhitha Vedire

专题命中 规划决策 :planning(title)

AI总结 研究通过星型世界工作空间重塑实现 Franka 手臂的反应式 3D 运动规划,核心方法是聚类并替换相交膨胀障碍物、用零空间人工势场项避障,对比重塑与未重塑表示,结果显示有前景但也有局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16977 2026-07-21 math.OC cs.IT cs.RO math.IT 新提交 71%

Relative Entropy-Bounded Ambiguous Chance Constraints for Robust Planning in Nonlinear Systems

非线性系统中用于鲁棒规划的相对熵有界模糊机会约束

Trevor N. Wolf, Jay W. McMahon

机构 * Smead Department of Aerospace Engineering Sciences, University of Colorado Boulder(苏尔兹德部航空航天工程科学系,科罗拉多大学博尔德分校)

专题命中 规划决策 :planning(title)

AI总结 研究非线性系统中分布模糊下随机控制的风险概率定义,利用指数积分变分表达式界定预期风险值,给出确定相对熵距离的方法,为处理非线性协方差转向问题中的分布模糊提供框架并通过航天器制导示例展示成果。

Comments European Control Conference (ECC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17959 2026-07-21 physics.soc-ph 新提交 71%

Where onshore wind meets forests: electricity system planning with ecologically graded forests

陆上风电与森林相遇之处:基于生态分级森林的电力系统规划

Muhammad Shahzad Javed, Marianne Zeyringer, Johannes Rahlf, Oliver Moen Snoksrud

专题命中 规划决策 :planning(title)

AI总结 该研究针对陆上风电扩张与森林保护的竞争问题,通过对森林按生态价值分级并结合电力系统模型,以挪威为例量化分析,明确了森林保护与风电扩张的权衡,为平衡二者竞争策略提供可转移基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16161 2026-07-20 cs.ET 新提交 71%

Adaptive Fault Injection Planning for Multi-Layer Self-Healing AI Infrastructure

用于多层自愈人工智能基础设施的自适应故障注入规划

Saurabh Kulkarni, Yuxin Yang, Rohan Kulkarni, Gautam Nayak

专题命中 规划决策 :planning(title)

AI总结 研究多层自愈人工智能基础设施故障注入规划问题,提出ADA-ST自适应方法,用加权故障传播图指导跨层场景选择,构建平台故障传播图,弥补现有测试覆盖不足,通过迭代达全边覆盖,还能跨硬件代际传递知识,揭示跨层漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14625 2026-07-17 astro-ph.EP astro-ph.IM 新提交 71%

Observational planning for the 2026 August 5 Falcon 9 Upper Stage lunar impact

2026年8月5日猎鹰9号上面级月球撞击的观测规划

Benjamin Fernando, Jennifer Heldmann, Bill Grey, John Ortiz, Bryan Euser, Darryl Z. Seligman, Eunhyeuk Kim, Anthony Colaprete, Elisa Maria Alessi, Detlef Koschny, Anthony Cook, Joel Green, Patrick King, Stacy Teng, Dawn Graninger, Arnold Goldberg, William Cooke, Mike F. Skrutskie, Kevin Schlaufman, Nicholas Schmerr, Carly M. Donahue, Carl A. Schmidt, Nancy J. Chanover

专题命中 规划决策 :planning(title)

AI总结 2026年8月5日猎鹰9号上面级将撞击月球,此次撞击产生的闪光和羽流可被观测,为实时记录人造撞击提供契机,还能测试用于月球表面撞击定位的流程,鼓励专业和业余天文学家进行观测。

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12178 2026-07-15 eess.SY cs.SY 新提交 71%

Dynamically Feasible Planning and Control in Complex Environments: a Scalable Systematic Approach

复杂环境下的动态可行规划与控制:一种可扩展的系统方法

Miguel Castroviejo-Fernandez, Ilya Kolmanovsky

专题命中 规划决策 :planning(title)

AI总结 针对受非凸约束的线性离散时间系统,提出生成安全集的方法及参考调节器,能保证系统安全与参考命令收敛,在线计算开销低,特定情况下安全集计算高效,通过仿真验证了方法的适用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12130 2026-07-15 cs.RO 新提交 71%

More than a Manipulator: Planning Propellant-Free Attitude Maneuvers for Free-Floating Spacecraft

不仅仅是一个操纵器:为自由漂浮航天器规划无推进剂姿态机动

Harsh G. Bhundiya, Avi Soval, Keenan Albee

机构 * University of Southern California(南加州大学)

专题命中 规划决策 :planning(title)

AI总结 研究利用机器人操纵器运动进行自由漂浮航天器无推进剂姿态控制,通过制定带约束的轨迹优化问题求解,展示多种系统轨迹,经与反作用轮阵列比较,证明其可作冗余或主要姿态控制系统,为空间应用提供框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11611 2026-07-14 cs.PL 新提交 71%

Mizzle: A Complete Concurrent Incorrectness Logic for Preventing False Alarms in Agentic Bug Finding

Mizzle:一种用于在智能体错误查找中防止误报的完整并发错误逻辑

Alexandre Moine, Sam Westrick, Joseph Tassarotti

专题命中 规划决策 :agentic(title)

AI总结 针对大语言模型在程序错误查找中产生大量误报的问题,提出Mizzle方法,它是一种用于并发程序的错误分离逻辑,在Rocq证明助手实现机械化,能防止误报且完整,还通过三种错误概念实例化并展示其可用于证明错误存在。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07139 2026-07-09 cs.RO 新提交 71%

Disturbance-aware Motion Planning for Over-actuated Underwater Vehicles Exploiting Actuation Redundancy for High-fidelity 3D Reconstruction

利用驱动冗余进行高保真 3D 重建的过驱动水下航行器的干扰感知运动规划

Yuer Gao, Tongqing Xu, Qingyang Liu, Yi Cai

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 规划决策 :planning(title)

AI总结 研究水下机器人驱动对感知的影响,利用过驱动平台冗余,通过搜索零空间最小化目标区域干扰,采用基于致动盘理论的尾流代理及冗余解决分配器,降低粒子速度,提高 3D 重建精度,支持自主扫描与辅助检查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06724 2026-07-09 cs.RO 新提交 71%

EvoPlan: Evolutionary Neuro-Symbolic Robot Planning with Spatio-Temporal Guarantees

EvoPlan:具有时空保证的进化神经符号机器人规划

Bhavya Sai Nukapotula, Samin Moosavi, Haoze Wang, Luke Duncan, Diya Shakkottai, Varun Murali, Srinivas Shakkottai

机构 * Texas A&M University(德克萨斯农工大学)

专题命中 规划决策 :planning(title)

AI总结 研究针对基于LLM的机器人规划器不足及经典PDDL规划器问题,提出含离线STL约束挖掘、进化PDDL规划器和受约束执行循环的神经符号框架,能保证计划属性,在基准测试中表现良好且可在无云环境下部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00215 2026-07-02 cs.RO 新提交 71%

ELMP: Efficient Learning for Motion Planning via Analytical Policy Gradients

ELMP: 通过解析策略梯度实现高效运动规划学习

Yixiao Li, Tifanny Portela, Jordis Herrmann, René Zurbrügg, Marco Hutter

机构 * Robotic Systems Lab, ETH Zürich(苏黎世联邦理工学院机器人系统实验室) ABB(ABB公司) ANYbotics(ANYbotics公司)

专题命中 规划决策 :planning(title)

AI总结 提出ELMP框架,利用可微运动学层和自监督微调,通过密集碰撞、目标到达和平滑性目标直接优化策略,避免专家数据收集,实现数据高效的运动规划适应。

Comments 8 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31425 2026-07-01 math.OC 新提交 71%

Joint Planning and Scheduling of Modular Vehicles for Passenger-Freight Integration

客货一体化模块化车辆的联合规划与调度

Wanru Chen, Jiaming Wu, Balázs Kulcsár

专题命中 规划决策 :planning(title)

AI总结 针对双向公交走廊,提出模块化车辆系统,通过联合优化服务路线、时刻表、车辆组成等,最小化成本并处理乘客需求不确定性,使用Benders分解算法求解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14064 2026-06-15 eess.SY cs.CE cs.SY 新提交 71%

HPC-Enabled Generator Importance Assessment for RTO-Scale Resource Adequacy Planning

基于高性能计算的RTO规模资源充裕度规划中的发电机重要性评估

Eve Tsybina, Nicholson Koukpaizan, Joshua Hambrick, Samim Konjicija, Slaven Peles

专题命中 规划决策 :planning(title)

AI总结 提出高性能计算框架,快速评估发电机重要性并排序,使分钟级完成传统计算密集型评估成为可能,支持更广泛的发电组合场景分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13232 2026-06-12 cs.RO 新提交 71%

WT-UMI: Tactile-based Whole-Body Manipulation via Force-Supervised Contact-Aware Planning

WT-UMI: 基于触觉的全身操控通过力监督的接触感知规划

Jaehwi Jang, Zhaoyuan Gu, Alfred Cueva, Zimeng Chai, Junjie Sheng, Thong Nguyen, Himank Galundia, Yifan Wu, Huishu Xue, Isaac Legene, Ojas Mediratta, Davin Doan, Andrew Collins, Sarah Sadegh, KyoungMok Kim, Rishita Dhalbisoi, Zun Chen, Ye Zhao

机构 * The Institute for Robotics and Intelligent Machines, Georgia Institute of Technology(机器人与智能机械研究所,佐治亚理工学院)

专题命中 规划决策 :planning(title)

AI总结 提出WT-UMI系统,结合人体演示与遥操作数据,通过力监督规划器预测末端执行器位姿和接触力轨迹,并利用触觉导纳控制器提升全身操控性能。

Comments 18 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12306 2026-06-11 cs.RO 新提交 71%

UGV-Conditioned Multi-UAV Informative Planning on a Shared Exposure Belief

基于共享暴露信念的UGV条件多无人机信息规划

Lars Oerlemans, Moji Shi, Marija Popovic

机构 * MAVLab, Faculty of Aerospace Engineering, TU Delft(马文实验室,航空航天工程学院,代尔夫特理工大学)

专题命中 规划决策 :planning(title)

AI总结 提出一种协调无人机编队降低地面车辆在未知威胁区导航风险的方法,通过共享暴露信念引导感知并减少冗余覆盖,仿真显示累积暴露降低38%,冗余覆盖从38.8%降至3.7%。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09550 2026-06-09 cs.DB 新提交 71%

InquiTree: Evaluating AI Agents in the Scientific Inquiry Loop with Paper-Derived Research Trees

InquiTree: 在论文衍生研究树中评估科学探究循环中的AI智能体

Shaoyang Cui

专题命中 规划决策 :AI agent(title)

AI总结 提出InquiTree诊断环境,将科学探究形式化为交互式研究树,揭示AI智能体在长周期交互中关键判断退化(认知隧道)及对训练数据外论文性能下降的局限性。

Comments 17 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09014 2026-06-09 cs.IT math.IT 新提交 71%

Deterministic versus Stochastic Optimization for Joint Path Planning and Dynamic Time Splitting in Multiple-UAV-Cached IoT Networks

多无人机缓存物联网网络中联合路径规划与动态时间分割的确定性优化与随机优化

Trinh Van Chien, Dinh Thanh Tung, Waqas Khalid, Ngo Cong Dung, Banh Thi Quynh Mai, Symeon Chatzinotas

专题命中 规划决策 :planning(title)

AI总结 针对多无人机缓存物联网网络,提出基于块坐标下降和遗传算法的联合优化方法,实现动态时间分割、轨迹和传输功率的协同优化,吞吐量提升至少31%。

Comments 15 pages, 6 figures, and 7 tables. Accepted by the IEEE IoT Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16033 2026-08-18 cs.CL 新提交 70%

$R^3$-Bench: LLMs Struggle with Resource-Rational Reasoning under Shared Budgets

$R^3$-Bench:大语言模型在共享预算下的资源理性推理能力存在不足

Peisong Wang, Zhiwei Ma, Bowen Liu, Feixue Liu, Aochuan Chen, Chenyi Zi, Hongchuan Zeng, Yuhan Li, Jia Li

机构 * The University of Hong Kong(香港大学) Hunyuan Team, Tencent(腾讯混元团队)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.CL

AI总结 $R^3$-Bench测试发现,大语言模型在共享预算下的资源理性推理存在不足,其表现出的单问题能力与共享预算下的实际表现存在差距。

Comments Code is available at https://github.com/NineAbyss/R-3-Bench . The dataset is available at https://huggingface.co/datasets/R-3-Bench/R-3-Bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15703 2026-08-18 cs.AI 新提交 70%

HyMem: Hierarchical Context Management for Long-Horizon Agents via Information Isolation

HyMem:基于信息隔离的长程智能体分层上下文管理

XinQi Wang, Jinwei Xiao, Sijia Cui, Hongming Zhang, Yanna Wang, Qingyang Zhang, Bo Xu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Nanjing Artificial Intelligence Research of IA(IA南京人工智能研究院)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 针对LLM智能体长程任务上下文杂乱导致推理性能下降的问题,提出分层上下文管理框架HyMem,通过功能分层隔离推理与规划,在GAIA、Browsecomp-plus数据集上取得优于基线的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14522 2026-08-17 cs.AI 新提交 70%

Participatory Moral AI Is Not Neutral: The Invisible Hand of Developers

参与式道德人工智能并非中立:开发者的隐形之手

Taenyun Kim, Edyta Bogucka, Daniele Quercia

专题命中 规划决策 :AI agent(abstract,abstract_cn);分类 cs.AI

AI总结 该研究发现,道德AI偏好征集流程中的特征范围、投票者构成、问题措辞三项关键选择会显著影响AI决策,仅靠投票汇总无法实现公平透明的AI,需对流程各阶段审计披露。

Comments 35 pages, 11 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09574 2026-08-11 cs.AI 新提交 70%

The Politician, the Liar, and the Obedient Worker: Emerging Behavior of LLM Agents in Hierarchical Games

政客、骗子与顺从的工人:层级博弈中大语言模型智能体的涌现行为

Fatemeh Seyedin, Adrian Weller, Jinhyuk Yun, Mahmoudreza Babaei

机构 * Soongsil University(崇实大学) GISMA University(GISMA大学)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 该研究通过层级博弈实验测试6种大语言模型智能体,发现其在不同制度下会涌现出撒谎、私下交易等类似人类的治理失效行为,且模型家族会影响领导层更迭。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09443 2026-08-11 cs.AI 新提交 70%

Coupled Graph--Policy Distillation for Personalized Medication Safety in Older Adults with Multimorbidity

面向多病老年患者个性化用药安全的耦合图-策略蒸馏方法

Zihan Wang, Anglin Liu, Rongyi Wang, Dantong Li, Yi Lu, Siqing Yuan, Hongxia Xu, Zhongtian Long, Jintai Chen

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出ATLAS框架与GeriMedBench基准,通过耦合图-策略蒸馏实现多病老年患者的个性化用药安全,在多基准测试中表现优于对比系统,获临床医生更高评分。

详情

展开后加载摘要…

URL PDF HTML 收藏