arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-21 至 2026-08-21 共收录 100 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 4 篇

2608.20314 2026-08-21 cs.AI 新提交 90%

MidTool: Mid-training Data Synthesis for Agentic Tool Use

MidTool:面向智能体工具使用的训练中期数据合成

Fengqing Jiang, Yite Wang, Boyi Liu, Zhaoyang Wang, Canwen Xu, Zhewei Yao, Radha Poovendran, Yuxiong He

机构 * University of Washington(华盛顿大学) Snowflake(雪花公司) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 工具调用 :tool use(title,abstract);agentic(title,abstract);tool-use(abstract);workflow(abstract)

AI总结 本研究提出MidTool流水线,构建面向智能体工具使用的训练中期数据,在MidTool-Mix上微调Qwen3模型,可显著提升工具使用相关下游任务性能,证明通用工具使用需专门训练中期调整。

Comments Data & Model: this https URL (https://hf.co/collections/MidTool/midtool-release)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20317 2026-08-21 cs.IR 新提交 82%

Projecting BrowseComp-Plus onto ClimbMix: Toward More Realistic Corpora for Agentic Search

将BrowseComp-Plus映射到ClimbMix:构建更符合智能体搜索需求的真实语料库

Sahel Sharifymoghaddam, Lingwei Gu, Yijun Ge, Jimmy Lin

专题命中 工具调用 :agentic(title,abstract);agent(abstract)

AI总结 该研究将BrowseComp-Plus的查询映射到NVIDIA的ClimbMix语料库,构建了与基准无关的映射流水线,生成57个有效查询,使智能体搜索难度向检索环节转移,发布了相关资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19303 2026-08-21 cs.AI cs.CL cs.SE 新提交 75%

Outcome Monitors: Recovery Affordances for Silent Tool Failures

结果监控器:针对静默工具故障的恢复可行性

Sugam Panthi, Rabab Abdelfattah

专题命中 工具调用 :agent(abstract,abstract_cn);分类 cs.AI、cs.CL、cs.SE

AI总结 该研究针对智能体决策中的静默工具故障问题,提出结果监控器方法,可检测结果契约违反并提供恢复工具,显著提升ToolMaze和tau-bench任务的完成率。

Comments 16 pages (9 main + 7 pages supplementary material), 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19933 2026-08-21 cond-mat.mtrl-sci 新提交 50%

Building atomistic models of heterointerfaces with optimal transport

基于最优传输构建异质界面的原子模型

Yuxuan Tang, Keith T. Butler

专题命中 工具调用 :workflow(abstract)

AI总结 本文提出融合格罗莫夫-瓦瑟斯坦(FGW)距离结合贝叶斯优化的工作流,构建异质界面原子模型,可高效筛选界面晶格匹配关系,性能优于随机搜索及预训练MACE能量引导方法。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 31 篇

2608.20087 2026-08-21 cs.RO cs.AI 新提交 83%

Towards Professional Tennis Styles for Humanoid Robots with Adaptive Motion Planning and Tracking

面向人形机器人的专业网球风格:自适应运动规划与跟踪

Tao Huang, Ruofei Liu, Xuchen Tang, Xinyin Zhang, Junli Ren, Huayi Wang, Feiyu Jia, Yukai Qi, Kangning Yin, Weishuai Zeng, Lipeng Chen, Xi Li, Ting Wu, Kailin Li, Ruoli Dai, Jingbo Wang, Lei Han, Jiangmiao Pang

机构 * Noitom Robotics(诺亦腾机器人) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Dobot Robotics(越疆机器人)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本研究提出AdaPT框架,从广播视频学习专业网球风格,通过自适应机制弥合仿真到现实的差距,在Unitree G1和Dobot Atom人形机器人上验证了有效性,为相关系统提供了见解。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20084 2026-08-21 cs.RO cs.AI 新提交 83%

Evidence-Gated Task and Motion Planning with Vision-Language Models

基于视觉语言模型的证据门控任务与运动规划

Tsunehiko Tanaka, Matthew Stephenson, Alistair Macvicar, Edgar Simo-Serra

机构 * Waseda University(早稻田大学) Flinders University(弗林德斯大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 针对机器人执行自然语言指令长时操纵任务时的部分可观测问题,提出 EAFG 框架,通过视觉证据获取与可行性门控提升食谱完成率并减少无效操纵尝试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19880 2026-08-21 cs.AI cs.CL cs.LG 新提交 82%

EnvHarness: Awakening Static Worlds for Agent Learning

EnvHarness:为智能体学习唤醒静态环境

Chengsong Huang, Zifeng Wang, Rujun Han, Jun Yan, Yanfei Chen, Zoey CuiZhu, Ke Jiang, Peng Xia, Han Yu, Yufan Zhuang, Yifei Ming, Jiaqi Pan, Bhavana Dalvi Mishra, Jiaxin Huang, Burak Gokturk, Tomas Pfister, Chen-Yu Lee

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 EnvHarness是包裹静态环境的可编程插件层,结合EnvRigger自动合成组件,在多领域基准测试中提升智能体学习性能,减少执行步骤并支持策略与环境协同进化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20237 2026-08-21 cs.AI 新提交 79%

Rule-Compliant Visual Spatial Planning for Multimodal Large Language Models

面向多模态大语言模型的符合规则的视觉空间规划

Yu Chen, Ting Lei, Yaoyi Li, Jia Cai, Zhecen Wu, Yang Liu

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王选计算机研究所) Yinwang Intelligent Technology Co., Ltd(银湾智能科技有限公司)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 该研究针对多模态大语言模型的规则遵循空间规划问题,构建了RuleMaze基准,提出语言-逻辑-函数混合方法和解耦多模态规划(DMP),提升了规则遵循度与规划成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19842 2026-08-21 cs.AI 新提交 79%

SAPO: Single-Rollout Autoregressive Policy Optimization for Agentic Reinforcement Learning

SAPO:用于智能体强化学习的单回滚自回归策略优化

Dayang Liang, Lang Feng, Bo An, Yunlong Liu

机构 * Xiamen University(厦门大学) Nanyang Technological University(南洋理工大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 本研究针对智能体强化学习现有方法的三大局限,提出SAPO框架,其共享策略与价值函数的自回归主干,结合广义优势估计器,在ALFWorld、WebShop任务上性能优于PPO和GRPO,内存与计算效率更高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20284 2026-08-21 cs.CV cs.RO 新提交 78%

Towards Surgical World-Action Modeling: A Preliminary Joint Visual-Trajectory Forecasting for Surgical Motion Planning

面向外科世界动作建模:外科手术运动规划的初步联合视觉-轨迹预测

Weiliang Huang, Huanrong Liu, Bob Zhang, Qi Dou, Zhen Chen, Yun Gu, Guy Rosman, Qingbiao Li

机构 * University of Macau(澳门大学) University of Macau Advanced Research Institute in Hengqin(澳门大学横琴研究院) The Chinese University of Hong Kong(香港中文大学) The Hong Kong Polytechnic University(香港理工大学) Shanghai Jiao Tong University(上海交通大学) Tongren Hospital(同仁医院) Duke University(杜克大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出初步联合视觉-轨迹世界动作模型,从历史手术观测中同时预测未来视觉状态与器械轨迹,采用分块自回归展开法,提升了预测性能,证明了联合预测的可行性,但仍存在长范围预测的退化与误差挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19537 2026-08-21 cs.RO 新提交 78%

Multimodal Trajectory Planning for Surface Vehicles using Turning Circle-based Control Barrier Functions

基于转向圆型控制障碍函数的水面航行器多模态轨迹规划

Changyu Lee

机构 * Kongju National University(公州国立大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文针对动态环境下自主水面航行器,提出结合MPC与TC-CBF的无引导路径多模态轨迹规划框架,可提升避碰成功率、减少安全违规并缓解局部极小问题。

Comments This work has been submitted to an Elsevier journal for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19453 2026-08-21 cs.RO cs.FL 新提交 78%

When Automata Meet Streams: Temporal Logic Compilation for Stream-Based Robotics Task and Motion Planning

自动机与流的结合:面向基于流的机器人任务与运动规划的时态逻辑编译

Sayem Nazmuz Zaman, Cyrus Neary

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究提出SAM-TD方法,将LTL_f约束编译为自动机并嵌入动作模式,实现基于流的TAMP对动态生成对象的时态约束处理,在机器人环境中验证了其可行性与竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19794 2026-08-21 cs.AI cs.RO 新提交 74%

Towards general embodied intelligence: integrating large language models, knowledge bases, and reasoning capabilities to build the next generation of AI agents

迈向通用具身智能:整合大语言模型、知识库与推理能力以构建下一代AI智能体

Fujiang Yuan, Xia Huang, Lusheng Wang, Jun Ding, Zhen Tian, Yuxin Wang, Shaojie Gu, Yuki Funabora, Yanhong Peng, Zebing Mao

机构 * College of Mechanical Engineering, Chongqing University of Technology(重庆理工大学机械工程学院) James Watt School of Engineering, University of Glasgow(格拉斯哥大学詹姆斯·瓦特工程学院) School of Energy and Power, Jiangsu University of Science and Technology(江苏科技大学能源与动力学院) Magnesium Research Center, Kumamoto University(熊本大学镁研究中心) Department of Information and Communication Engineering, Nagoya University(名古屋大学信息与通信工程系) State Key Laboratory of Fluid Power and Mechatronic Systems, Zhejiang University(浙江大学流体动力与机电系统国家重点实验室)

专题命中 规划决策 :AI agent(title);分类 cs.AI

AI总结 本文综述以LLM为核心的智能系统演进,提出整合LLMs、KBs、RA与具身性的概念框架,明确高效LLM部署等五大挑战,为开发复杂动态环境下的自适应多模态智能体提供路线图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20319 2026-08-21 cs.CL cs.AI 新提交 73%

Inducing Task Models from Computer-Use Traces

从计算机使用轨迹中诱导任务模型

Yucheng Jiang, Zora Zhiruo Wang, Ruishi Chen, Diyi Yang

机构 * Stanford University(斯坦福大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划决策 :agent(abstract);workflow(abstract);分类 cs.AI、cs.CL

AI总结 该研究提出TMI方法,可从计算机使用轨迹中分离并发任务并诱导结构化任务模型,在恢复交织任务、重构执行步骤及提升任务准确率上均优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20336 2026-08-21 cs.CV 新提交 71%

WithEveryone: Unified Planning and Identity Grounding for Group Image Generation

WithEveryone:面向群体图像生成的统一规划与身份定位

Hengyuan Xu, Qixun Wang, Yiji Cheng, Miles Yang, Zhao Zhong, Wei Cheng, Xingjun Ma, Yu-gang Jiang

机构 * Fudan University(复旦大学) Hunyuan, Tencent(腾讯混元) The University of Hong Kong(香港大学)

专题命中 规划决策 :planning(title)

AI总结 针对多人物群体图像生成的身份保留难题,提出WithEveryone框架,通过布局定位身份损失等技术,提升了人脸相似度并降低伪影,实现高身份覆盖率与低重复率。

Comments Project Page: this http URL (http://doby-xu.github.io/WithEveryone/);Code will be released: this http URL (http://github.com/Doby-Xu/WithEveryone/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19661 2026-08-21 cs.RO 新提交 71%

World-Model-Grounded LLM Planning for AUV and ASV Navigation Near Offshore Wind Farms

面向近海风电场区域自主水下航行器(AUV)与自主水面航行器(ASV)导航的世界模型赋能大语言模型规划

Markus Buchholz, Ignacio Carlucho, Yvan R. Petillot

机构 * Norwegian Defence Research Establishment (FFI)(挪威国防研究机构(FFI)) School of Engineering & Physical Sciences, Heriot-Watt University(赫瑞瓦特大学工程与物理科学学院)

专题命中 规划决策 :planning(title)

AI总结 本研究提出世界模型赋能大语言模型规划方法,结合MPC闭环重规划器等组件,在近海风电场区域的AUV和ASV导航任务中,大幅降低目标距离误差,验证了其有效性。

Comments This work has been accepted to the IEEE IROS 2026 AQ2UASIM workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20026 2026-08-21 cs.CV cs.LG 新提交 70%

From Street View Imagery to Street Quality Indicators: Vision Language Inference for the Suburban 15-minute City

从街景图像到街道质量指标:面向郊区15分钟城市的视觉语言推理

Joan Perez, Giovanni Fusco

专题命中 规划决策 :planning(abstract);workflow(abstract);分类 cs.LG

AI总结 本文以法国尼斯东北部郊区为研究对象,采用开源的SAGAI工作流,利用视觉语言模型从街景图像评估街景质量,发现理想街景仅存在于部分郊区区域,证明了VLM可支持郊区城市诊断,助力循证规划。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19803 2026-08-21 cs.LG cs.AI cs.CL 新提交 67%

MileGPO: Milestone Inference with Local Evidence for Graph-Based Policy Optimization of Long-Horizon LLM Agents

MileGPO:面向长 horizon LLM 智能体的基于图策略优化的里程碑推理

Bo Qian, Yuting Wu, Shuang Zeng, Huaiyu Wan, Dalin Zhang, Jiqiang Liu

机构 * Beijing Jiaotong University(北京交通大学)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 针对长 horizon LLM 智能体强化学习的信用分配难题,提出 MileGPO 方法,通过里程碑发现、RCS、PCC 三项设计提升性能,在 ALFWorld 和 WebShop 上达 SOTA 且分布差距小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19760 2026-08-21 cs.LG cs.AI cs.CL 新提交 67%

Credit Without Ground Truth: Auditing Step-Level Credit Assignment in LLM Agents Against Executed Replay

无真实值的信用:针对执行重放的大语言模型智能体的步骤级信用分配审计

Haiyue Zhang

机构 * University of Southern California(南加州大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 该研究针对LLM智能体,在ALFWorld环境中审计步骤级信用分配,发现现有信用信号无法识别关键步骤,提出需匹配有效样本量比较信用规则。

Comments 49 pages, 7 figures. Pre-registered; frozen analysis plans and prompts included in the appendices. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19218 2026-08-21 cs.CL cs.AI cs.LG 新提交 67%

Time-Series Retrieval for Grounding Multimodal Language Models in Remaining Useful Life

用于将多模态语言模型与剩余使用寿命关联的时间序列检索

Valeriu Dimidov, Raphaël Frank

机构 * University of Luxembourg(卢森堡大学)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出时间序列检索关联的多模态大语言模型框架,在C-MAPSS基准FD001分区实验显示,该方法可提升RUL预测的误差与稳定性,且效果随模型容量变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20065 2026-08-21 cs.LG 新提交 57%

Orthogonal JEPA: Factorized Predictive States for Latent World Models

正交JEPA:用于潜在世界模型的分解预测状态

Taoyong Cui, Pheng Ann Heng, Wanli Ouyang

机构 * The Chinese University of Hong Kong (CUHK)(香港中文大学(CUHK))

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 该研究提出正交JEPA框架,通过正交预测分解改进潜在世界模型,在多类任务实验中评估了其表示质量、预测、规划及长时程稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19778 2026-08-21 cs.MA cs.AI 新提交 57%

Distilling Aggregate Mobility Statistics into a Language Model Policy for Post-Event Crowd Simulation

将聚合出行统计数据提炼为语言模型策略以用于事件后人群模拟

Tatsuya Amano, Hirozumi Yamaguchi

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 该研究针对仅能获取聚合出行统计数据的场景,通过微调语言模型人群智能体并结合迭代比例拟合与低秩适配器,降低了事件后人群模拟的目的地份额误差。

Comments 4 pages, 3 figures. Accepted as a short paper at ACM SIGSPATIAL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19669 2026-08-21 cs.CV cs.LG 新提交 57%

Scaffolding Minds: Optimizing Latent Visual Target Representations for Multimodal Reasoning

搭建心智:优化多模态推理的潜在视觉目标表示

Haoqiang Kang, Yinpeng Chen, Luyang Liu, Jesper Sparre Andersen, Abhijit Ogale, Baochen Sun, Lichan Hong, Ed H. Chi

机构 * Google DeepMind(谷歌DeepMind) UC San Diego(加州大学圣迭戈分校)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 针对潜在推理框架的 SFT 阶段潜在表示对齐差、RL 阶段缺乏探索性潜在轨迹的局限,提出 Scaffolding Minds,学习专用搭建编码器与 RL 采样器的均值方差,在多基准任务上取得显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19769 2026-08-21 eess.IV cs.CV 新提交 50%

AsymFeX: A Symmetry-Driven Framework for Ischemic Stroke Segmentation Across Imaging Modalities and Stroke Stages

AsymFeX:一种用于跨成像模态和卒中阶段的缺血性卒中分割的对称性驱动框架

Maunil Shah, Vaanathi Sundaresan

专题命中 规划决策 :planning(abstract)

AI总结 该研究提出与nnU-Net兼容的两阶段3D分割方法AsymFeX,通过对称性驱动设计跨模态跨卒中阶段实现缺血性卒中分割,在AISD等数据集上性能优于现有方法,具备临床应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20251 2026-08-21 cs.RO 新提交 50%

Video2DoorTraversal: Push Door Traversal via Simulated Door Twins

Video2DoorTraversal:通过模拟门孪生体实现推门穿越

Xincheng Tang, Yiji Chen, Youhan Xie, Wanyu Li, Zhengjie Shu, Lai Jiang, Wenkang Hu, Yitong Li, Jinchuang Zhang, Xibin Song, Ruigang Yang

机构 * Shanghai Jiao Tong University(上海交通大学) NeoWa Robotics(NeoWa机器人公司) Shandong University(山东大学)

专题命中 规划决策 :agent(abstract)

AI总结 本文提出Video2DoorTraversal框架,通过DoorTwin重构门孪生体,训练ArticuACT策略,实现轮腿式移动机械手开门穿越,在真实门与未见门上分别达到96.57%和80.95%的成功率。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19952 2026-08-21 cs.DS 新提交 50%

New Complexity Results for Fair Repetitive Scheduling

公平重复调度的新复杂性结果

Moran Koren, Michael L. Pinedo, Dvir Shabtay

专题命中 规划决策 :planning(abstract)

AI总结 本文针对单机器公平重复调度问题,解决了前人研究中遗留的三个复杂性问题,为该领域提供了新的理论进展。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19740 2026-08-21 cs.RO 新提交 50%

Keeping the Franka Emika Panda alive: a ROS 2 stack with a reliable position interface

保持Franka Emika Panda机器人正常运行:具备可靠位置接口的ROS 2软件栈

Antonio Langella, Davide Risi, Vincenzo Petrone, Enrico Ferrentino, Pasquale Chiacchio

机构 * University of Salerno(萨勒诺大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出开源ROS 2软件栈,解决Franka Emika Panda机器人外部位置接口不可靠问题,经多场景验证,降低人机协作应用开发门槛。

Comments 12 pages, 10 figures, submitted to ICINCO 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19671 2026-08-21 cs.RO 新提交 50%

SAGE: Ergodic Control for Autonomous and Adaptive Inspection of Subsea Infrastructure

SAGE:用于海底基础设施自主与自适应巡检的遍历控制

Markus Buchholz, Ignacio Carlucho, Yvan R. Petillot

机构 * Norwegian Defence Research Establishment (FFI)(挪威国防研究机构) School of Engineering & Physical Sciences, Heriot-Watt University(赫瑞瓦特大学工程与物理科学学院)

专题命中 规划决策 :planning(abstract)

AI总结 针对海底采油树巡检的风险动态变化问题,提出SAGE遍历控制架构,按实时传感器风险分布分配航行器时间,相比固定A*路径更频繁巡检高风险阀门,缩短泄漏未被发现的时间,且无需人工重新规划。

Comments This work has been accepted to the IEEE IROS 2026 AQ2UASIM workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19666 2026-08-21 cs.CV 新提交 50%

MUST-PET: MUltimodal Self-supervised learning across Tracers for whole-body PET/CT-based lesion segmentation

MUST-PET:用于基于全身PET/CT的病灶分割的跨示踪剂多模态自监督学习

Bashirul Azam Biswas, Amartya Bhattacharya, Biratal Raj Wagle, Matthew E. Maeder, James B. Yu, Indrani Bhattacharya

机构 * Geisel School of Medicine at Dartmouth(达特茅斯盖泽尔医学院) Dartmouth Hitchcock Medical Center(达特茅斯-希区柯克医疗中心)

专题命中 规划决策 :planning(abstract)

AI总结 本研究提出MUST-PET多模态自监督学习框架,通过跨示踪剂的上下文感知掩码重建,实现全身PET-CT病灶的标注高效、可泛化分割,性能优于从头训练模型。

Comments Submitted to SPIE CAD 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19574 2026-08-21 cs.RO 新提交 50%

HiTac-WAM: A Hierarchical Tactile World Action Model for Contact-Rich Robot Manipulation

HiTac-WAM:一种用于接触丰富型机器人操作的分层触觉世界动作模型

Chao Xue, Chaofan Zhang, Wenxuan Ma, Guocai Yao, Shaowei Cui, Shuo Wang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ImprintX Robotics(ImprintX机器人公司) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出HiTac-WAM这一分层触觉世界动作模型,通过分层结构建模触觉状态的物理依赖关系,在机器人接触操作任务中提升了预测精度与操作成功率。

Comments 8 pages, 7 figures, and 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏