arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-09 至 2026-06-09 共收录 315 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 96 篇

2606.07723 2026-06-09 cs.RO 新提交 75%

VoLo: A Physical Orchestrator for Open-Vocabulary Long-Horizon Manipulation

VoLo: 面向开放词汇长时程操控的物理编排器

Siyi Chen, Hugo Hadfield, Alex Zook, Mikaela Angelina Uy, Chan Hee Song, Erwin Coumans, Xuning Yang, Faisal Ladhak, Qing Qu, Stan Birchfield, Jonathan Tremblay, Valts Blukis

机构 * NVIDIA(英伟达) University of Michigan(密歇根大学)

专题命中 规划决策 :agent(abstract);AI agent(abstract);planning(abstract)

AI总结 提出VoLoAgent,利用VLM将VLA/WAM作为可中断工具进行物理编排,实现开放词汇长时程操控,并在新基准RoboVoLo上显著优于现有系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14211 2026-06-09 cs.AI cs.LG 版本更新 74%

ASH: Agents that Self-Hone via Embodied Learning

ASH: 通过具身学习自我精炼的智能体

Benjamin Schneider, Xavier Schneider, Victor Zhong, Sun Sun

机构 * University of Waterloo(多伦多大学) National Research Council Canada(加拿大国家研究理事会)

专题命中 规划决策 :planning(abstract);agentic(abstract);分类 cs.AI、cs.LG;AI agent(comments)

AI总结 提出ASH系统,通过从无标签互联网视频中学习具身策略,利用自改进循环和逆动力学模型,在长时域任务中显著超越基线方法。

Comments Published as a workshop paper at ICML 2026 Workshop on Scalable Learning and Optimization for Efficient Multimodal AI Agents

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09550 2026-06-09 cs.DB 新提交 71%

InquiTree: Evaluating AI Agents in the Scientific Inquiry Loop with Paper-Derived Research Trees

InquiTree: 在论文衍生研究树中评估科学探究循环中的AI智能体

Shaoyang Cui

专题命中 规划决策 :AI agent(title)

AI总结 提出InquiTree诊断环境,将科学探究形式化为交互式研究树,揭示AI智能体在长周期交互中关键判断退化(认知隧道)及对训练数据外论文性能下降的局限性。

Comments 17 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09014 2026-06-09 cs.IT math.IT 新提交 71%

Deterministic versus Stochastic Optimization for Joint Path Planning and Dynamic Time Splitting in Multiple-UAV-Cached IoT Networks

多无人机缓存物联网网络中联合路径规划与动态时间分割的确定性优化与随机优化

Trinh Van Chien, Dinh Thanh Tung, Waqas Khalid, Ngo Cong Dung, Banh Thi Quynh Mai, Symeon Chatzinotas

专题命中 规划决策 :planning(title)

AI总结 针对多无人机缓存物联网网络,提出基于块坐标下降和遗传算法的联合优化方法,实现动态时间分割、轨迹和传输功率的协同优化,吞吐量提升至少31%。

Comments 15 pages, 6 figures, and 7 tables. Accepted by the IEEE IoT Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01205 2026-06-09 cs.RO 版本更新 71%

ImagineUAV: Aerial Vision-Language Navigation via World-Action Modeling and Kinodynamic Planning

ImagineUAV:通过世界-动作建模和动力学规划实现空中视觉语言导航

Xuchen Liu, Jiawei Huang, Shihao Xia, Bingxi Liu, Jinqiang Cui, Jiankun Yang

机构 * Pengcheng Laboratory(鹏城实验室) School of Computer Science and Cyber Engineering(计算机科学与网络工程学院) Guangzhou University(广州大学) Southern University of Science and Technology(南方科技大学)

专题命中 规划决策 :planning(title)

AI总结 针对无人机视觉语言导航中几何不一致和动力学失配问题,提出基于潜视频扩散模型的世界-动作建模框架,通过生成未来观测推断6自由度运动并规划无碰撞轨迹,以1.3B参数在基准和实际飞行中超越先前方法。

Comments Video demo: https://www.youtube.com/watch?v=Ng1alP0yhc0

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04957 2026-06-09 math.OC 版本更新 71%

Optimality of Symmetric Independent Policies under Decentralized Mean-Field Information Sharing for Stochastic Teams and Equivalence with McKean-Vlasov Control of a Representative Agent

分散均值场信息共享下随机团队的对称独立策略的最优性及与代表智能体的McKean-Vlasov控制的等价性

Sina Sanjari, Naci Saldi, Serdar Yüksel

专题命中 规划决策 :agent(title)

AI总结 研究有限和无限决策者随机可交换团队的最优策略,证明有限人口最优策略收敛到无限人口的分散对称独立策略,并建立与McKean-Vlasov控制的关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09709 2026-06-09 cs.CL 新提交 70%

IS-CoT: Breaking the Long-form Generation Collapse via Interleaved Structural Thinking

IS-CoT: 通过交错结构思维打破长文本生成崩溃

Zechen Sun, Yuyang Sun, Zecheng Tang, Juntao Li, Wenpeng Hu, Wenliang Chen, Zhunchen Luo, Guotong Geng, Min Zhang

机构 * Institute of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院) Information Research Center of Military Science, PLA Academy of Military Science(军事科学院军事科学信息研究中心)

专题命中 规划决策 :planning(abstract);agentic(abstract);分类 cs.CL

AI总结 针对大语言模型在长文本生成中因静态层次规划导致长度崩溃的问题,提出交错结构思维链(IS-CoT)框架,通过动态规划-写作-反思循环实现持续策略调整,训练IS-Writer-8B模型在长文本基准上取得最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09549 2026-06-09 cs.CR cs.AI 新提交 70%

SecureClaw: Clawing Back Control of LLM Agents

SecureClaw: 夺回对LLM智能体的控制

Yuhan Ma, Stefan Schmid

机构 * TU Berlin(柏林技术大学)

专题命中 规划决策 :agent(abstract,abstract_cn);分类 cs.AI

AI总结 针对工具使用型LLM智能体的双重安全漏洞,提出双边界架构SecureClaw,在效果汇点实施授权、在读边界实施明文隔离,通过预览-提交协议和可信网关实现安全控制,在多个基准上保持可用性的同时将攻击成功率降至接近零。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09371 2026-06-09 cs.AI 新提交 70%

Capability-Aligned Hierarchical Learning for Tool-Augmented LLMs

面向工具增强型大语言模型的能力对齐分层学习

Haotong Yang, Ting Long, Yi Chang

机构 * Jilin University(吉林大学)

专题命中 规划决策 :tool-use(abstract);planning(abstract);分类 cs.AI

AI总结 提出CAHL方法,利用RLVR联合优化高层规划器与低层执行器,解决分层工具学习中的规划-执行对齐问题,在多个基准上验证有效性。

Comments 14 pages, 5 figures, 6 tables. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08596 2026-06-09 cs.AI cs.HC 新提交 70%

Distilling LLM Reasoning into an Interpretable Policy Tree for Human-AI Collaboration

将LLM推理蒸馏为可解释的策略树用于人机协作

Beiwen Zhang, Yongheng Liang, Guowei Zou, Haitao Wang, Hejun Wu

机构 * Sun Yat-sen University(中山大学)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出Co-pi-tree方法,通过将大语言模型推理蒸馏为可执行策略树,在Overcooked-AI中平均奖励提升35.4%,同时减少77.7%的LLM查询和97.1%的测试延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07974 2026-06-09 cs.RO cs.AI 新提交 70%

PRISM: PRior-guided Imagination Sampling in world Models

PRISM:世界模型中基于先验引导的想象采样

Yuhai Wang, Jiawei Xia, Rongxuan Zhou, Xiao Hu, Yongliang Shi, Jing Du, Yang Ye

机构 * Northeastern University(东北大学) University of California, Berkeley(加州大学伯克利分校) Qiyuan Lab(启元实验室) University of Florida(佛罗里达大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 提出PRISM框架,通过从世界模型编码器提取状态条件高斯先验,并利用精度加权高斯乘积更新规划器的采样分布,在不增加架构复杂度的情况下显著提升基于模型的连续控制性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17640 2026-06-09 stat.AP cs.SE 版本更新 70%

huff: A Python package for Market Area Analysis

huff:用于市场区域分析的Python包

Thomas Wieland

专题命中 规划决策 :planning(abstract);workflow(abstract);分类 cs.SE

AI总结 huff包提供市场区域分析的完整流程,包括数据导入、OD矩阵构建、模型分析、参数估计和可视化,适用于经济地理学和健康地理学研究。

Comments v1.2.1; added references, update of scientific usage and PyPI usage statistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08876 2026-06-09 physics.geo-ph 新提交 67%

RO-LiDAR GeoQuickView: A Web Platform for Exploring Public LiDAR-Derived Elevation Data in Romania

RO-LiDAR GeoQuickView:探索罗马尼亚公共LiDAR衍生高程数据的Web平台

Alexandru Hegyi

专题命中 规划决策 :planning(abstract);workflow(abstract)

AI总结 提出一个非商业Web-GIS平台RO-LiDAR GeoQuickView,整合公共LiDAR衍生数字地形模型等高程数据,提供标准化山体阴影可视化、参与式景观记录和空间索引,以解决数据碎片化和专业处理限制问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07720 2026-06-09 cs.AI cs.CL cs.LG 新提交 67%

Why Limit the Residual Stream to Layers and Not Tokens? Persistent Memory for Continuous Latent Reasoning

为什么将残差流限制在层而不是令牌?用于连续潜在推理的持久记忆

Mujtaba Farhan, Maheep Chaudhary

机构 * University of Cambridge(剑桥大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 针对CoCoNuT在潜在空间推理中因中间隐藏状态被覆盖导致概念瓶颈的问题,提出AGCLR模型,通过门控概念流持久记忆机制,在GSM8K、HotpotQA和ProsQA上取得一致提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17947 2026-06-09 cs.CR cs.AI cs.CL cs.LG cs.MA 版本更新 67%

PLAGUE: Plug-and-play framework for Lifelong Adaptive Generation of Multi-turn Exploits

PLAGUE:面向多轮利用的终身自适应生成的即插即用框架

Neeladri Bhuiya, Madhav Aggarwal, Diptanshu Purwar

机构 * A10 Networks, Inc.(A10网络公司) University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出PLAGUE框架,通过终身学习启发的三阶段设计(Primer、Planner、Finisher)实现高效多轮越狱攻击,在o3和Opus 4.1等强安全模型上ASR提升超30%。

Comments Accepted in ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12591 2026-06-09 q-fin.TR math.OC math.PR 版本更新 67%

Optimal Rebate Design: Incentives, Competition and Efficiency in Auction Markets

最优返利设计:拍卖市场中的激励、竞争与效率

Thibaut Mastrolia, Tianrui Xu

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 研究拍卖市场中交易所通过返利政策激励做市商、缩小清算价与资产价值价差以提升市场效率的最优设计问题,采用主从博弈框架和深度BSDE方法求解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09825 2026-06-09 cs.LG cs.AI cs.SY eess.SY math.OC 新提交 62%

An Agency-Transferring Model-Free Policy Enhancement Technique

一种无模型策略增强的代理转移技术

Anton Bolychev, Georgiy Malaniya, Sinan Ibrahim, Pavel Osinenko

机构 * Center for Engineering Systems and Sciences(工程系统与科学中心) Central University(中央大学) Sirius University of Science and Technology(天狼星科技大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 提出一种将次优基线策略嵌入强化学习训练的方法,通过逐步从基线策略向可学习策略转移代理权,提升训练效率并最终获得超越基线的独立策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08932 2026-06-09 cs.CL cs.AI cs.CE 新提交 62%

From Statute to Control Flow: Span-Grounded Deontic Trees for Defeasible Scope Parsing

从法规到控制流:基于跨度义务树的可废止范围解析

Jian Chen, Siyuan Li, Chucheng Wan, Zixuan Yuan

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Sun Yat-Sen University(中山大学)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 提出NormBench基准和跨度义务树(SG-DT)中间表示,用于诊断和缓解规则遵循模型中的静默范围遗漏(SSO)问题,揭示递归衰减和可审计性陷阱两种病理,并通过约束输出改善树结构保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08633 2026-06-09 cs.AI cs.LG 新提交 62%

Towards Long-Horizon Vessel Trajectory and Destination Forecasting with Reasoning Large Language Models

面向长时域船舶轨迹与目的地预测的推理型大语言模型

Hongwei Wang, Miao Zhou, Fengde Wang, Yuting Wang, Jiewen Yu, Jun-Yan He, Bohao Qu, Wanbing Zhang, Xiuju Fu, Qing Guo, Zipei Fan, Yingying Xing, Yi Yuan

机构 * Institute of High Performance Computing (IHPC), A*STAR, Singapore(新加坡科技研究局高性能计算研究所) The Key Laboratory of Road and Traffic Engineering, Ministry of Education, Tongji University(同济大学道路与交通工程教育部重点实验室) Meituan Inc., Shenzhen, China(美团(深圳)) Centre for Frontier AI Research (CFAR), A*STAR, Singapore(新加坡科技研究局前沿人工智能研究中心) Nankai University(南开大学) School of Artificial Intelligence, Jilin University(吉林大学人工智能学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 提出基于可验证奖励强化学习(RLVR)的Maritime LLM后训练框架,将轨迹转化为语义文本,通过物理有效性约束和层次匹配提升长时域(30天)预测精度,4B模型表现最优。

Comments The IEEE International Conference on Intelligent Transportation Systems (ITSC) 2026, Naples, Italy

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08484 2026-06-09 cs.LG cs.AI 新提交 62%

STELLAR: Spatio-Temporal Environmental Learning with Latent Alignment and Refinement for Long-Tailed Species Distribution Modeling

STELLAR: 面向长尾物种分布建模的时空环境学习与潜在对齐精炼

Shufeng Kong, Tao Yu, Yuanyuan Wei, Caihua Liu, Junwen Bai, Yingheng Wang, Marc Grimson, Daniel Fink, Carla P. Gomes

机构 * Sun Yat-sen University(中山大学) Cornell University(康奈尔大学) Foshan University(佛山大学) Cornell Lab of Ornithology(康奈尔鸟类学实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 提出STELLAR框架,通过图-时间编码器、上下文锚定潜在对齐和不平衡感知解码模块,联合优化动态栖息地上下文和群落结构,有效解决物种分布建模中的时空耦合与长尾不平衡问题。

Comments Accept by IJCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07710 2026-06-09 cs.LG cs.AI 新提交 62%

WhiFlash: Accelerating Speculative Decoding with Token-Level Cross-Paradigm Routing

WhiFlash: 通过令牌级跨范式路由加速推测解码

Young D. Kwon, Miles Williams, Rui Li, Alexandros Kouris, Stylianos I. Venieris

机构 * Samsung AI Center, Cambridge, UK(三星AI中心,剑桥,英国)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 提出WhiFlash,首个统一自回归与扩散并行草稿的跨范式推测解码方法,通过细粒度路由和缓存优化实现高达69.6%的吞吐量提升。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12666 2026-06-09 cs.LG cs.AI 版本更新 62%

RetroReasoner: A Reasoning LLM for Strategic Retrosynthesis Prediction

RetroReasoner:一种用于战略 retrosynthesis 预测的推理 LLM

Hanbum Ko, Chanhui Lee, Ye Rin Kim, Rodrigo Hormazabal, Sehui Han, Sungbin Lim, Sungwoong Kim

机构 * Department of Artificial Intelligence, Korea University(韩国大学人工智能系) Department of Statistics, Korea University(韩国大学统计系) Materials Intelligence Lab, LG AI Research(LG人工智能研究实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 RetroReasoner 通过监督微调和强化学习,捕捉化学家基于断键策略的推理过程,提升 retrosynthesis 预测的准确性和多样性。

Comments 35 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06077 2026-06-09 cs.IT cs.AI cs.LG math.IT math.OC 版本更新 62%

One if by Land, Two if by Sea, Three if by Four Seas, and More to Come -- Values of Perception, Prediction, Communication, and Common Sense in Decision Making

一陆二海三四海,更多将至——感知、预测、通信与常识在决策中的价值

Aolin Xu

机构 * Aolin Xu(徐傲林)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文严格定义决策中感知、预测、通信和常识的价值,发现无预测的感知价值可能为负,而预测价值非负,并应用于自主决策系统设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09662 2026-06-09 cs.CL 新提交 57%

When Built-in Thinking Helps and Hurts: Constraint-Level Error Shifts in Instruction Following

当内置思考既有帮助又有害:指令遵循中的约束级错误转移

Sai Adith Senthil Kumar

机构 * George Mason University(乔治梅森大学)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 研究大型推理模型(LRM)的思考模式对指令遵循的影响,发现思考会改变错误模式而非统一降低性能,其中规划类约束改善而精确类约束恶化,并通过分析思考轨迹和激活修补揭示了机制。

Comments 16 pages, 7 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09617 2026-06-09 math.OC cs.AI cs.CY cs.SY eess.SY 新提交 57%

Powering the Future of AI: Navigating the Trade-offs for Europe's Energy Transition and Net-Zero Goals

赋能AI未来:应对欧洲能源转型与净零目标的权衡

Mohammad Hemmati, Gbemi Oluleye, Vassilis M. Charitopoulos

机构 * Department of Chemical Engineering, Sargent Centre for Process Systems Engineering, University College London (UCL)(化学工程系、过程系统工程中心、伦敦大学学院(UCL)) Centre for Environmental Policy, Imperial College London(环境政策中心、伦敦帝国理工学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 通过21种AI增长情景下的空间优化模型,量化AI对欧洲电力需求、容量、排放和运行的影响,发现AI到2050年可能增加73-723 TWh需求,导致2030-2050年累计排放超调67-181 MtCO2,且AI基础设施选址将更依赖稳定电源和系统灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09556 2026-06-09 cs.AI 新提交 57%

AI Scientists Are Only as Good as Their Evidence: A Stratified Ablation of Proprietary Data and Reasoning Skills in Drug-Asset Valuation

AI科学家的能力取决于其证据:药物资产估值中专有数据与推理技能的分层消融研究

Yinan Wang

机构 * Noah AI Research(Noah AI研究)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 通过分层消融实验,发现药物资产估值中AI科学家的决策上限由专有证据集决定,而非仅依赖推理框架;加入专有数据后决策质量显著提升。

Comments Preprint; 2 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09028 2026-06-09 cs.CV cs.AI cs.RO 新提交 57%

ATM: Action-Consistency Transfer Matrix for Diagnosing and Improving Latent World Models

ATM:用于诊断和改进潜在世界模型的动作一致性转移矩阵

Jiaheng Chen

机构 * School of Software, Northeastern University(东北大学软件学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 提出ATM矩阵,通过轻量级探针比较真实与预测潜在转移中的动作信息,无需模拟器即可诊断世界模型质量,并引入AITS利用动作可识别性作为训练信号提升下游规划。

Comments 13 pages, 3 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08896 2026-06-09 cs.AI 新提交 57%

FAME: Forecastability-Aware Mixture of Experts for Heterogeneous Time Series Forecasting

FAME: 面向异构时间序列预测的可预测性感知专家混合模型

Qianyang Li, Xingjun Zhang, Shaoxun Wang, Tao Peng, Jia Wei

机构 * Sun Yat-sen University(中山大学) Guangdong Key Laboratory of Information Security Technology(广东省信息安全技术重点实验室) Ministry of Education Key Laboratory of Machine Intelligence and Advanced Computing(教育部机器智能与先进计算重点实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对大规模异构时间序列预测中单一模型性能不足的问题,提出可预测性感知的稀疏专家混合框架FAME,通过多维可预测性指纹和成本感知路由,在工业数据集上实现12.4%的MSE降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08791 2026-06-09 econ.EM cs.AI q-fin.PM q-fin.RM q-fin.ST 新提交 57%

Evaluating AI Investment Strategies

评估AI投资策略

Irene Aldridge

机构 * ablemarkets.com(ablemarkets公司)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 研究通过可观测输入输出审计黑箱算法决策者,提出动态策略累积遗憾的精确分解,扩展至多期随机动态规划,并给出偏差修正与轨迹估计器。

Comments 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08775 2026-06-09 cs.RO cs.AI 新提交 57%

Unifying Object-Centric World Models and Diffusion Policy: A Hierarchical Framework for Multi-Stage Robotic Tasks

统一对象中心世界模型与扩散策略:多阶段机器人任务的分层框架

Raktim Gautam Goswami, Prashanth Krishnamurthy, Yann LeCun, Farshad Khorrami

机构 * Tandon School of Engineering, New York University(纽约大学坦登工程学院) Courant Institute of Mathematical Sciences, New York University(纽约大学库朗数学科学研究所) AMI Labs(AMI实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 提出WorldDP分层框架,结合高层世界模型进行运行时子目标优化和低层扩散策略执行,利用对象中心表示解耦环境实体,实现多阶段机器人操作任务的有效规划与执行。

详情

展开后加载摘要…

URL PDF HTML 收藏