arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-11 至 2026-06-11 共收录 93 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 14 篇

2606.11680 2026-06-11 cs.AI cs.CL cs.LG 新提交 81%

Organize then Retrieve: Hierarchical Memory Navigation for Efficient Agents

先组织再检索:面向高效智能体的层次化记忆导航

Hao-Lun Hsu, Nikki Lijing Kuang, Boyi Liu, Zhewei Yao, Yuxiong He

机构 * Duke University(杜克大学) Snowflake AI Research(Snowflake AI研究)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI、cs.LG

AI总结 提出HORMA框架,通过构建文件系统式的层次化记忆结构并利用强化学习训练的轻量级导航代理,实现高效检索,在长时任务中提升性能并降低令牌消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13207 2026-06-11 cs.RO cs.CV 版本更新 81%

PIGEON: VLM-Driven Object Navigation via Points of Interest Selection

PIGEON: 通过兴趣点选择的VLM驱动物体导航

Cheng Peng, Zhenzhe Zhang, Xiaobao Wei, Yanhao Zhang, Heng Wang, Pengwei Wang, Zhongyuan Wang, Cheng Chi, Shanghang Zhang, Jing Liu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院) Peking University(北京大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 提出PIGEON框架,将物体导航建模为基于原始观测的稀疏决策问题,通过兴趣点(PoI)作为视觉决策单元,结合VLM选择关键点,实现零样本SOTA性能并迁移至主动具身问答。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11636 2026-06-11 cs.RO 新提交 79%

SAFER-Nav: Enhancing Safety for Visual Robot Navigation via Segmentation-Aware Fine-Tuning

SAFER-Nav: 通过分割感知微调增强视觉机器人导航的安全性

Geonyeong Ko, Giung Lee, Changjoo Nam

机构 * Dept. of Electronic Engineering, Sogang University(西江大学电子工程系) Dept. of Computer Science, Rice University(莱斯大学计算机科学系) Vertical Labs, Co., Ltd.(Vertical Labs 有限公司)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出SAFER-Nav方法,通过分割感知微调将障碍物边界和可通行空间结构直接融入导航策略,降低碰撞频率并保持目标到达性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11535 2026-06-11 cs.RO 新提交 79%

Adversarial Attacks on Learned Policies for Surgical Robotic Tasks

针对手术机器人任务学习策略的对抗攻击

Shutong Jin, Ziyang Chen, Preethi Satish, Paavan Gupta, Florian T. Pokorny, Ken Goldberg

机构 * University of California, Berkeley(加州大学伯克利分校) KTH Royal Institute of Technology(瑞典皇家理工学院)

专题命中 具身导航 :robotic(title);robotics(abstract);分类 cs.RO

AI总结 研究学习型策略在机器人辅助手术中易受对抗攻击的脆弱性,提出破坏性和引导性攻击方法,实验表明攻击可使手术子任务成功率平均降低61%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22497 2026-06-11 cs.HC cs.NA math.NA 版本更新 78%

Catheter Monitoring in Intelligent Endovascular Navigation Systems: Interactive Simulations and Mixed Reality for Enhanced Navigational Awareness

智能血管内导航系统中的导管监测:用于增强导航意识的交互式模拟与混合现实

Veronica Ruozzi, Giovanni Battista Regazzo, Maria Chiara Palumbo, Wim-Alexander Beckers, Mouloud Ourak, Xiu Zhang, Francesca Perico, Alessandro Caimi, Emmanuel Vander Poorten, Emiliano Votta

专题命中 具身导航 :navigation(title,abstract)

AI总结 提出一种结合实时导管形状重建、交互式模拟和混合现实可视化的框架,通过有限元模型和传感器数据监测导管-血管相互作用,实验验证位移误差低于2.33毫米。

Comments Int J CARS (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12027 2026-06-11 cs.RO 新提交 70%

Learning Unions of Convex Sets via Invertible Latent Decomposition for Path Planning

通过可逆潜在分解学习凸集并集用于路径规划

Taerim Yoon, Dongho Kang, Kisang Park, Junha Cha, Stelian Coros, Sungjoon Choi

机构 * Korea University(高丽大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 具身导航 :manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 提出ILD框架,联合学习可逆映射和潜在空间中的显式凸多面体并集,实现路径规划,并通过可见性引导采样保持凸集连通性,在多种环境中取得更高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06100 2026-06-11 eess.SP cs.AI cs.LG cs.RO 版本更新 69%

CredibleDFGO: Differentiable Factor Graph Optimization with Credibility Supervision

可信DFGO:具有可信度监督的可微因子图优化

Liang Qian, Penggao Yan, Penghui Xu, Li-Ta Hsu

机构 * Department of Aeronautical and Aviation Engineering(航空与航空工程系)

专题命中 具身导航 :navigation(abstract,comments);分类 cs.RO、cs.AI、cs.LG

AI总结 针对GNSS协方差不可靠问题,提出CredibleDFGO框架,通过可微高斯-牛顿求解器与加权生成网络,利用适当评分规则监督预测分布,提升协方差可信度与定位精度。

Comments Submitted to NAVIGATION: Journal of the Institute of Navigation

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12306 2026-06-11 cs.RO 新提交 57%

UGV-Conditioned Multi-UAV Informative Planning on a Shared Exposure Belief

基于共享暴露信念的UGV条件多无人机信息规划

Lars Oerlemans, Moji Shi, Marija Popovic

机构 * MAVLab, Faculty of Aerospace Engineering, TU Delft(马文实验室,航空航天工程学院,代尔夫特理工大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 提出一种协调无人机编队降低地面车辆在未知威胁区导航风险的方法,通过共享暴露信念引导感知并减少冗余覆盖,仿真显示累积暴露降低38%,冗余覆盖从38.8%降至3.7%。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11489 2026-06-11 cs.RO 新提交 57%

Steering Multirobot Behavior via Closed-Loop Affine Activation Editing

通过闭环仿射激活编辑引导多机器人行为

Satyajeet Das, Darren Chiu, Shashank Hegde, Gaurav S. Sukhatme

机构 * University of Southern California(南加州大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 提出CLAE框架,在推理时通过编辑冻结策略的中间激活来引导多机器人行为,无需微调或重训练,并在多四旋翼导航任务中验证了速度控制、编队保持和规避监控等新行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08744 2026-06-11 cs.CV 版本更新 57%

MB-Loc: Multi-planar Bird's-eye-view Localization in outdoor LiDAR scenes

MB-Loc:室外LiDAR场景中的多平面鸟瞰图定位

Ayaan Choudhury, Preet Savalia, Anirudh Pydah, Avinash Sharma

机构 * Indian Institute of Technology Jodhpur(印度理工学院焦特布尔分校)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 提出MB-Loc框架,通过将LiDAR扫描投影为2.5D多平面鸟瞰图表示,结合KL正则化隐瓶颈和3D空间增强,实现轻量级、视角鲁棒的场景坐标回归定位,在NCLT数据集上达到实时推理并超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10018 2026-06-11 cs.RO 版本更新 57%

LEMON-Mapping: Loop-Enhanced Large-Scale Multi-Session Point Cloud Merging and Optimization for Globally Consistent Mapping

LEMON-Mapping: 面向全局一致建图的环路增强大规模多会话点云融合与优化

Lijie Wang, Xiaoyi Zhong, Ziyi Xu, Kaixin Chai, Anke Zhao, Tianyu Zhao, Changjian Jiang, Qianhao Wang, Xieyuanli Chen, Fei Gao

机构 * Institute of CyberSystems and Control, Zhejiang University(浙江大学控制系统研究所) The Huzhou Institute, Zhejiang University(浙江大学湖州研究院) The State Key Laboratory of Industrial Control Technology, College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院国家工业控制技术重点实验室) The College of Intelligence Science and Technology, National University of Defense Technology(国防科技大学智能科学与技术学院)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 提出LEMON-Mapping框架,通过鲁棒环路处理、空间光束法平差和基于PGO的优化,解决多机器人建图中重叠区域发散和模糊问题,实现高精度全局一致点云融合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11442 2026-06-11 cs.SE cs.PL 新提交 50%

Web-Native Graphical EMF Model Editors

Web原生图形化EMF模型编辑器

Susanne Göbel, Ralf Lämmel

专题命中 具身导航 :navigation(abstract)

AI总结 提出纯Web框架EMFular,基于Ecore模型自动生成图形编辑器,支持EMF一致性操作与Angular扩展,实现低代码生成、高可定制与无后端部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11747 2026-06-11 physics.atom-ph 新提交 50%

Ambiguity-Free Inertial Measurement with Multi-Wavelength Atom Interferometry

多波长原子干涉仪的无模糊惯性测量

Wei-Chen Jia, Yue Xin, Ke Shen, Yan-Ying Feng

专题命中 具身导航 :navigation(abstract)

AI总结 通过多波长原子干涉合成包络实现无模糊惯性测量,实验演示了双轴旋转与加速度传感,并解决了传统原子干涉仪的相位模糊问题。

Comments 10 pages,4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06911 2026-06-11 cs.HC 50%

Physics-driven Sonification for Improving Multisensory Needle Guidance in Percutaneous Epicardial Access

物理驱动声化改善经皮心外膜入路中的多感官针引导

Veronica Ruozzi, Sasan Matinfar, Pasquale Vergara, Alessandro Albanesi, Serena Dell'Aversana, Stefano Carugo, Gianluigi Buccoliero, Nassir Navab, Alberto Redaelli, Emiliano Votta

专题命中 具身导航 :navigation(abstract)

AI总结 针对透视下跳动心脏的经皮心外膜入路中针尖定位难题,提出基于物理驱动声化的扩展现实多感官导航方法,通过4D CTA动态心脏解剖重建与实时针追踪,结合多层物理膜模型听觉编码,显著提升导航安全性、准确性和降低认知负荷。

Comments This work has been submitted to the IEEE for possible publication

Journal ref in IEEE Access, vol. 14, pp. 80371-80385, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 6 篇

2606.12072 2026-06-11 cs.CV 新提交 85%

World Model Self-Distillation: Training World Models to Solve General Tasks

世界模型自蒸馏:训练世界模型以解决通用任务

Sebastian Stapf, Pablo Acuaviva Huertos, Aram Davtyan, Paolo Favaro

机构 * Department of Computer Science(计算机科学系)

专题命中 具身推理 :world model(title,abstract);robotics(abstract);robotic(abstract);分类 cs.CV

AI总结 提出结合自蒸馏与强化学习的框架,从预训练视频生成器中提取任务解决能力,无需配对任务视频,在基准测试中超越原始模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11482 2026-06-11 cs.SI cs.CL 新提交 78%

Building Social World Models with Large Language Models

用大型语言模型构建社会世界模型

Haofei Yu, Yining Zhao, Guanyu Lin, Jiaxuan You

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 具身推理 :world model(title,abstract)

AI总结 提出社会世界模型(SWM)框架,利用LLM从社会数据中挖掘时间模式,学习社会信念的状态转移函数,无需人工标注或普查数据,在预测市场基准上超越时序基础模型。

Comments 9 pages. ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13628 2026-06-11 cs.NI 版本更新 78%

Compact LLM Deployment and World Model Assisted Offloading in Mobile Edge Computing

紧凑型大语言模型部署与世界模型辅助的卸载在移动边缘计算中

Ruichen Zhang, Xiaofeng Luo, Jiayi He, Jiawen Kang, Zehui Xiong, Shiwen Mao

专题命中 具身推理 :world model(title,abstract)

AI总结 本文研究了移动边缘计算网络中紧凑型大语言模型(LLM)部署和世界模型辅助的推断卸载问题,提出了一种边缘紧凑型LLM部署(ECLD)框架,结合结构化剪枝、低比特量化和知识蒸馏来构建可部署于边缘的LLM变种,并通过四个互补指标评估这些模型。基于这些紧凑模型,提出了一个MEC卸载优化问题,旨在最小化长期平均推断延迟,同时满足设备能耗预算和LLM特定的服务质量约束。为了解决未知且时间变化的网络动态问题,开发了一种世界模型-近端策略优化(PPO)算法,该算法在原策略优化算法中加入了学习的递归世界模型,以提供改进的价值目标和短时间想象回放。

Comments 16 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12316 2026-06-11 cs.CV 新提交 74%

Slots, Transitions, Loops: Learning Composable World Models for ARC

槽、转换、循环:学习可组合的ARC世界模型

Gege Gao, Bernhard Schölkopf, Andreas Geiger

机构 * University of Tübingen(图宾根大学) ETH Zürich(苏黎世联邦理工学院)

专题命中 具身推理 :world model(title);分类 cs.CV

AI总结 提出Loop-OWM架构,通过颜色原型槽、演示条件任务摘要和循环转换模型,学习ARC任务中的视觉符号规则,在ARC-1和ARC-2上超越基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11417 2026-06-11 cs.LG cs.AI stat.ML 新提交 62%

Signed Compression Progress on a Sealed Audit is Goodhart-Resistant

密封审计上的有符号压缩进展是古德哈特抵抗的

Ayush Mittal, Dhruv Gupta

专题命中 具身推理 :world model(abstract);分类 cs.AI、cs.LG

AI总结 提出有符号压缩进展作为内在动机,证明其累积奖励等于审计改进,且对有限审计面板具有假阳性预算,抵抗古德哈特定律。

Comments 16 pages, 7 figures. Lean 4 (Mathlib) mechanized core and ARC-TGI experiment code: https://github.com/Zetetic-Dhruv/audit-compression-progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12053 2026-06-11 cs.RO 版本更新 57%

Closing the Motion Execution Gap: From Semantic Motion Task Constraints to Kinematic Control

弥合运动执行差距:从语义运动任务约束到运动学控制

Simon Stelter, Vanessa Hassouna, Malte Huerkamp, Michael Beetz

机构 * University of Bremen(不莱梅大学)

专题命中 具身推理 :world model(abstract);分类 cs.RO

AI总结 本文提出通过运动状态图实现语义约束与可执行机器人运动的连接,利用统一的可微运动学世界模型实现世界中心的运动规范与跨平台泛化,采用基于lMPC的任务函数方法确保任务切换的平滑过渡。

Comments 9 pages, 8 figures, to be published in IJCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 8 篇

2606.08530 2026-06-11 cs.RO cs.AI 版本更新 88%

GEAR-VLA: Learning Geometry-Aware Action Representations for Generalizable Robotic Manipulation

GEAR-VLA:学习几何感知的动作表示以实现可泛化的机器人操作

Yuan Zhang, Shiqi Zhang, Yedong Shen, Shuai Dong, Jiajun Deng, Xin Zhang, Yuxuan Gao, Jiajia Wu, Xin Nie, Zhiyuan Cheng, Jianmin Ji, Yanyong Zhang, Xingyi Zhang, Jia Pan

机构 * Anhui University(安徽大学) University of Science and Technology of China(中国科学技术大学) iFLYTEK(科大讯飞)

专题命中 机器人基础模型 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.AI

AI总结 提出GEAR-VLA框架,通过粗到细的动作学习、语义对齐的3D集成和具身规范化,学习统一的几何感知动作表示,实现跨物体、背景和机器人的泛化操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11618 2026-06-11 cs.IT math.IT 新提交 88%

Vision-Language-Action Models Meet World Models: Embodied Agentic AI for Low-Altitude Wireless Networks

视觉-语言-动作模型遇见世界模型:面向低空无线网络的具身智能体AI

Feibo Jiang, Li Dong, Lei Mao, Kezhi Wang, Cunhua Pan, Dong In Kim, Naofal Al-Dhahir

专题命中 机器人基础模型 :embodied agent(title,abstract);world model(title,abstract)

AI总结 提出具身智能体无人机框架,以VLA模型为核心实现端到端决策,引入世界模型建模环境动态,通过记忆与反射机制形成闭环优化,实现低空无线网络的鲁棒自主控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06904 2026-06-11 cs.RO cs.CV 版本更新 81%

ActionMap: Robot Policy Learning via Voxel Action Heatmap

ActionMap: 基于体素动作热图的机器人策略学习

Pei Yang, Hai Ci, Yanzhe Chen, Qi Lv, Han Cai, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室) NVIDIA(英伟达)

专题命中 机器人基础模型 :robot policy(title);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 提出ActionMap,一种将动作空间建模为体素热图的动作解码器,替代现有VLA模型中的单点预测器,在LIBERO仿真和真实Franka操作中提升性能和数据效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11906 2026-06-11 cs.CL 新提交 75%

When Does Language Matter? Multilingual Instructions Reveal Step-wise Language Sensitivity in Vision-Language-Action Models

语言何时重要?多语言指令揭示视觉-语言-动作模型中的逐步语言敏感性

Xuan Dong, Zhe Han, Tianhao Niu, Qingfu Zhu, Wanxiang Che

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 机器人基础模型 :embodied agent(abstract);manipulation(abstract);robotic(abstract)

AI总结 本研究通过将LIBERO基准翻译成十种语言,首次系统评估了VLA模型的多语言鲁棒性,发现非英语指令下成功率下降30-50%,并基于步骤级语言敏感性提出推理时对齐干预,显著提升性能。

Comments Accepted to ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12403 2026-06-11 cs.RO 新提交 70%

World Pilot: Steering Vision-Language-Action Models with World-Action Priors

World Pilot: 用世界动作先验引导视觉-语言-动作模型

Zefu Lin, Rongxu Cui, Junjia Xu, Xiaojuan Jin, Wenling Li, Lue Fan, Zhaoxiang Zhang

机构 * Institute of Automation, Chinese Academy of Sciences (CASIA)(中国科学院自动化研究所) Nanjing University(南京大学) Beihang University(北京航空航天大学)

专题命中 机器人基础模型 :manipulation(abstract);world model(abstract);分类 cs.RO

AI总结 提出World Pilot框架,通过世界动作模型(WAM)的潜在引导和动作引导两条路径,为VLA模型提供场景演化先验和轨迹级运动提示,在LIBERO-Plus零样本OOD基准上达到84.7%的总成功率,并在多个真实机器人操作任务中取得最高成功率。

Comments Project Website: https://world-pilot.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12105 2026-06-11 cs.RO cs.CV cs.LG 新提交 67%

DAM-VLA: Decoupled Asynchronous Multimodal Vision Language Action model

DAM-VLA: 解耦异步多模态视觉语言动作模型

Pankhuri Vanjani, Zhuoyue Li, Jakub Suliga, Moritz Reuss, Gianluca Geraci, Xinkai Jiang, Rudolf Lioutikov

机构 * Intuitive Robots Lab, Karlsruhe Institute of Technology (KIT)(直觉机器人实验室,卡尔斯鲁厄理工学院) NVIDIA(英伟达) Robotics Institute of Germany(德国机器人研究所)

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 针对VLA模型同步时钟与物理交互中不同模态频率不匹配的问题,提出DAM-VLA,通过解耦各模态时间处理、维护传感器速率更新的潜在缓冲区,并利用门控交叉注意力整合高频模态,在7个真实操作任务中平均成功率提升至95.2%。

Comments 17 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11743 2026-06-11 cs.RO cs.GR cs.LG 新提交 62%

TacCoRL: Integrating Tactile Feedback into VLA via Simulation

TacCoRL: 通过仿真将触觉反馈集成到视觉-语言-动作模型中

Siyu Ma, Yuqi Liang, Chang Yu, Yunuo Chen, Hao Su, Yixin Zhu, Yin Yang, Chenfanfu Jiang

机构 * University of California, Los Angeles(加利福尼亚大学洛杉矶分校) University of California, San Diego(加利福尼亚大学圣迭戈分校) University of Electronic Science and Technology of China(电子科技大学) Peking University(北京大学) University of Utah(犹他大学)

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO、cs.LG

AI总结 提出TacCoRL框架,通过仿真与真实联合训练和强化学习,将触觉反馈注入视觉-语言-动作策略,在接触密集型任务中平均成功率提升22.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11221 2026-06-11 cs.CV 新提交 57%

LAST: Bridging Vision-Language and Action Manifolds via Gromov-Wasserstein Alignment

LAST: 通过Gromov-Wasserstein对齐连接视觉-语言与动作流形

Huaihai Lyu, Chaofan Chen, Yuheng Ji, Xiansheng Chen, Pengwei Wang, Shanghang Zhang, Changsheng Xu

机构 * National Engineering Laboratory for Intelligent Information Processing(智能信息处理国家级工程实验室) University of Science and Technology of China(中国科学技术大学)

专题命中 机器人基础模型 :robotic(abstract);分类 cs.CV

AI总结 提出LAST方法,通过李代数线性化和局部度量离散化,对齐视觉-语言语义几何与动作流形,解决异构空间不兼容问题,提升VLA模型收敛性和泛化性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 9 篇

2604.13733 2026-06-11 cs.LG cs.AI cs.RO 版本更新 85%

Vision-Language-Action Jump-Starting for Reinforcement Learning Robotic Agents

视觉-语言-动作跳跃启动用于强化学习机器人智能体

Angelo Moroncelli, Roberto Zanetti, Marco Maccarini, Loris Roveda

机构 * University of Applied Science and Arts of Southern Switzerland, Department of Innovative Technologies(瑞士南方应用科学与艺术大学创新技术系) Università della Svizzera Italiana, Faculty of Informatics, Lugano, Switzerland(瑞士意大利大学信息学院,卢加诺,瑞士)

专题命中 模仿学习与强化学习 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 提出VLAJS方法,通过稀疏的VLA高层动作建议引导PPO探索,结合方向性动作一致性正则化,提升强化学习在长时域操作任务中的样本效率,并在仿真和真实机器人上验证。

Comments ICRA 2026 Workshop on Reinforcement Learning in the Era of Imitation Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12365 2026-06-11 cs.RO cs.AI 新提交 81%

Ambient Diffusion Policy: Imitation Learning from Suboptimal Data in Robotics

环境扩散策略:从次优数据中进行机器人模仿学习

Adam Wei, Nicholas Pfaff, Thomas Cohn, Arif Kerem Dayı, Constantinos Daskalakis, Giannis Daras, Russ Tedrake

机构 * MIT(麻省理工学院)

专题命中 模仿学习与强化学习 :robotics(title,abstract);分类 cs.RO、cs.AI

AI总结 提出环境扩散策略,通过噪声依赖的数据使用从次优数据中提取有用特征,在六项任务上优于现有方法,最高提升33%。

Comments 14 pages (main body), 52 pages total. Project website: https://ambient-diffusion-policy.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏