arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 22033 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 22033 篇

2606.13279 2026-06-12 cs.RO 新提交 83%

See Selectively, Act Adaptively: Dual-Level Structural Decomposition for Bimanual Robot Manipulation

选择性观察,适应性行动:双水平结构分解用于双臂机器人操作

Yoon-Ji Choi, Young-Chae Son, Soo-Chul Lim

机构 * Dongguk University(东国大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出基于双水平结构分解的双臂操作VLA框架,通过视觉选择路由和动作专家混合机制分别处理视觉相关性和双臂交互模式,在模拟和真实任务中成功率分别提升27.7%和43.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11818 2026-06-11 cs.RO 新提交 83%

Human-Guided Co-Manipulation of Carbon Fiber Plies

碳纤维铺层的人机协同操作

Rami Ojanen, James Fant-Male, Roel Pieters

机构 * Automation Technology and Mechanical Engineering, Tampere University(坦佩雷大学自动化技术与机械工程系)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 针对柔性材料自动化处理困难的问题,本文提出结合语音指令、视觉腕部跟踪和力/柔顺控制的多模态方法,实现碳纤维铺层的高效人机协同操作。

Comments Accepted to the 35th IEEE International Conference on Robot and Human Interactive Communication (RO-MAN 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10899 2026-06-10 cs.RO 新提交 83%

MV-Actor: Aligning Multi-View Semantics and Spatial Awareness for Bimanual Manipulation

MV-Actor:对齐多视角语义与空间感知以实现双臂操作

Yinchen Tian, Huan Li, Muyao Peng, Xi Wang, Yan Wang, You Yang

机构 * School of Electronic Information and Communications, Huazhong University of Science and Technology(华中科技大学电子信息与通信学院) Institute for AI Industry Research (AIR), Tsinghua University(清华大学智能产业研究院) AIR Wuxi Innovation Center, Tsinghua University(清华大学智能产业研究院无锡创新中心)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出MV-Actor框架,通过多视角语义交互和语义-空间令牌交互统一语义与空间表示,并利用引导度量深度修复模块处理深度噪声,在PerAct2基准上达到87.8%平均成功率。

Comments 14 pages,9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09215 2026-06-09 cs.RO 新提交 83%

MotionWAM: Towards Foundation World Action Models for Real-Time Humanoid Loco-Manipulation

MotionWAM:迈向实时人形机器人全身操作的基础世界动作模型

Jia Zheng, Teli Ma, Yudong Fan, Zifan Wang, Shuo Yang, Junwei Liang

机构 * Mondo Robotics HKUST (GZ)(香港科技大学(广州)) HKUST(香港科技大学)

专题命中 机器人操作 :manipulation(title,abstract);world model(abstract);分类 cs.RO

AI总结 提出MotionWAM,一种实时世界动作模型,通过统一运动潜变量和全身动作令牌,实现单目相机驱动的自主人形机器人全身操作,在真实任务上成功率比VLA基线高30%以上。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08737 2026-06-09 cs.RO 新提交 83%

Dream-Tac: A Unified Tactile World Action Model for Contact-Rich Robot Manipulation

Dream-Tac: 用于接触丰富机器人操作任务的统一触觉世界动作模型

Yunfan Lou, Yifan Ye, Yankai Fu, Jun Cen, Xiaowei Chi, Yaoxu Lyu, Peidong Jia, Sirui Han, Zhihe Lu, Shanghang Zhang

机构 * Peking University(北京大学) The Hong Kong University of Science and Technology(香港科技大学) Nanjing University(南京大学) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室)

专题命中 机器人操作 :manipulation(title,abstract);world model(abstract);分类 cs.RO

AI总结 提出Dream-Tac统一触觉世界动作模型,通过接触门控视觉-触觉融合和接触感知注意力偏置,联合建模动作、未来视觉观察和触觉动态,在六项接触丰富操作任务中平均动作准确率提升31.7%。

Comments 16 pages,13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08564 2026-06-09 cs.RO 新提交 83%

Real-IKEA: Physical Fidelity is the Prerequisite for Robust Manipulation

Real-IKEA:物理保真度是鲁棒操作的前提

Kunqi Xu, Zhenhao Huang, Siyuan Luo, Ziqiu Zeng, Fan Shi

机构 * National University of Singapore(新加坡国立大学) Peking University(北京大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 针对仿真与现实物理差异导致操作鲁棒性不足的问题,提出Real-IKEA数据集与仿真框架,通过高保真资产和阻力校准配置,使强化学习策略发现优先利用机械优势的鲁棒策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20689 2026-06-09 cs.RO 版本更新 83%

FingerEye: Learning Dexterous Manipulation with Continuous Vision-Tactile Sensing

FingerEye:通过连续视觉-触觉感知学习灵巧操作

Zhixuan Xu, Yichen Li, Xuanye Wu, Tianyu Qiu, Lin Shao

机构 * National University of Singapore(新加坡国立大学) RoboScience(机器人科学) Huazhong University of Science and Technology(华中科技大学) South China University of Technology(华南理工大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 FingerEye通过连续视觉-触觉感知提升机器人灵巧操作,结合视觉和触觉反馈,在模拟和现实环境中使腕部策略的成功率提升超30个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06627 2026-06-08 cs.RO cs.AI cs.CV cs.LG 新提交 83%

What Matters When Cotraining Robot Manipulation Policies on Everyday Human Videos?

在日常生活人类视频上协同训练机器人操作策略时什么因素重要?

Richard Li, Aditya Prakash, Andrew Wen, Saurabh Gupta, Yilun Du, Pulkit Agrawal

机构 * Massachusetts Institute of Technology(麻省理工学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Harvard University(哈佛大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 研究利用日常互联网视频协同训练机器人操作策略时,手部姿态质量和运动差距对迁移的影响,提出一种协同训练方法,在低机器人数据场景下六个操作任务中绝对成功率提升29.7%。

Comments The project website is here: https://richardrl.github.io/what-matters-cotraining-human-videos/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11740 2026-06-08 cs.RO 版本更新 83%

From Pixels to Shelf: An Integrated Robotic System for Autonomous Supermarket Stocking with a Mobile Manipulator

从像素到货架:基于移动操作臂的自主超市补货集成机器人系统

Davide Peron, Victor Nan Fernandez-Ayala, Lukas Segelmark

机构 * Department of Information Engineering, University of Padova(帕多瓦大学信息工程系) Division of Decision and Control Systems, School of Electrical Engineering and Computer Science, KTH Royal Institute of Technology(皇家理工学院电气工程与计算机科学学院决策与控制系统系) Animum AB(Animum公司)

专题命中 机器人操作 :robotic(title,abstract);navigation(abstract);分类 cs.RO

AI总结 提出一种集成商用硬件与ROS2的模块化机器人系统,利用行为树规划、视觉检测和两步MPC控制,在700多次补货实验中实现98%以上的抓取成功率,但性能仍逊于人类工人。

Comments Preprint for CASE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05248 2026-06-05 cs.RO 83%

Inverse Manipulation through Symbolic Planning and Residual Operator Learning

通过符号规划与残差算子学习的逆操作

Yigit Yildirim, Giuseppe Rauso, Riccardo Caccavale, Alberto Finzi

机构 * University of Bologna(博洛尼亚大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种混合框架,结合STRIPS-like符号规划与残差强化学习,实现机器人操作任务的逆操作,在ManiSkill3 PushCube任务中验证了将近似符号逆操作转化为物理可行的逆技能。

Comments To be presented in PlanRob26

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04811 2026-06-05 cs.CV 83%

Dream.exe: Can Video Generation Models Dream Executable Robot Manipulation?

Dream.exe: 视频生成模型能否梦想出可执行的机器人操作?

Rui Zhao, Kaiming Yang, Jifeng Zhu, Siyang Chen, Ziqi Wang, Weijia Wu, Kevin Qinghong Lin, Heng Wang, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室) University of Oxford(牛津大学) Tencent(腾讯)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.CV

AI总结 提出Dream.exe评估框架,通过视频到执行流水线测试视频生成模型产生的运动能否转化为可执行的机器人操作,发现视觉质量不能预测可执行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08485 2026-06-04 cs.RO 83%

3PoinTr: 3D Point Tracks for Learning Manipulation from Unconstrained Human Videos

3PoinTr: 从无约束人类视频中通过3D点轨迹学习操作

Adam Hung, Bardienus Pieter Duisterhof, Jeffrey Ichnowski

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 机器人操作 :manipulation(title,abstract);robot policy(abstract);分类 cs.RO

AI总结 提出3PoinTr方法,通过预测密集3D点轨迹从无约束人类视频中预训练样本高效的机器人操作策略,在真实和模拟任务中显著优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
1905.01261 2026-06-04 eess.SY cs.RO cs.SY 83%

A Lyapunov-Based Approach to Exploit Asymmetries in Robotic Dual-Arm Task Resolution

基于李雅普诺夫的方法利用双臂机器人任务解决中的不对称性

Diogo Almeida, Yiannis Karayiannidis

机构 * Dept. of Electrical Eng., Chalmers University of Technology(电气工程系,查尔姆斯理工大学)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO

AI总结 本文提出了一种基于李雅普诺夫的方法,用于设计绝对运动任务的控制律并更新双臂之间的相对任务分布,通过数值实验展示了该方法相较于对称分布的优势。

Comments Accepted for publication at CDC 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1710.11088 2026-06-04 cs.RO cs.SY eess.SY 83%

Robust Cooperative Manipulation without Force/Torque Measurements: Control Design and Experiments

无需力/扭矩测量的鲁棒协同操作:控制设计与实验

Christos K. Verginis, Matteo Mastellaro, Dimos V. Dimarogonas

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出两种新型控制方法,用于由N个机器人代理协同操作物体,通过四元数反馈避免表示奇异,同时保证物体轨迹的暂态和稳态性能,且具有去中心化和抗扰动特性,无需力/扭矩测量,并通过仿真和实验验证理论结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
1705.01426 2026-06-04 cs.RO cs.SY eess.SY 83%

A Nonlinear Model Predictive Control Scheme for Cooperative Manipulation with Singularity and Collision Avoidance

一种用于协同操作的非线性模型预测控制方案,包含奇异性和避障

Alexandros Nikou, Christos Verginis, Shahab Heshmati-alamdari, Dimos V. Dimarogonas

专题命中 机器人操作 :manipulation(title);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出了一种非线性模型预测控制方案,用于在存在障碍物的有限工作空间中安全导航被N个机器人代理抓取的物体,同时避免碰撞和奇异配置。

Comments Simulation results with 3 agents added

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00966 2026-06-02 cs.RO 83%

Threading Optimization for Vision-Language-Action Model Inference in Low-Cost Smart Agricultural Manipulation

低成本智能农业机械臂中视觉-语言-动作模型推理的线程优化

Keith Truongcao, Christopher Nhu, Zijian An, Phong Nguyen, Siwei Cai, Lifeng Zhou

机构 * Department of Electrical Engineering, Drexel University(德雷塞尔大学电气工程系)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 针对低成本机械臂上VLA模型推理慢、精细动作调整难的问题,通过优化RTAC算法的线程实现,降低了端到端延迟并提高了响应性,在农产品操作任务中验证了控制稳定性和速度的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00576 2026-06-02 cs.RO 83%

Dynamic Resilient Spatio-Semantic Memory with Hybrid Localization for Mobile Manipulation

面向移动操作的动态弹性时空语义记忆与混合定位

Zhijie Yan, Shufei Li, Ze Zhang, Xin Liu, Yuhang Zheng, Zuoxu Wang

机构 * School of Mechanical Engineering and Automation, Beihang University(北京航空航天大学机械工程及自动化学院) Department of Systems Engineering, City University of Hong Kong(香港城市大学系统工程系) School of Computing, National University of Singapore(新加坡国立大学计算机学院)

专题命中 机器人操作 :manipulation(title,abstract);navigation(abstract);分类 cs.RO

AI总结 提出DREAM框架,通过在线构建时空语义体素记忆、冗余感知记忆剪枝和混合定位,实现无预建地图的动态室内移动操作,将长时任务成功率提升至55%-70%。

Comments Code, CAD model, and real-robot demonstrations are available at https://bjhyzj.github.io/dream-web

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00449 2026-06-02 cs.RO 83%

ROG-Grasp: Root-Oriented Geometry for Robotic Grasping and Placement

ROG-Grasp:面向根部的几何方法用于机器人抓取与放置

Zijian An, Augustus Sroka, Ran Yang, Bill Cai, Satoru Eto, Brian Poon, Kelvin Cai, Shijie Geng, Feng Liu, Yiming Feng, Lifeng Zhou

机构 * Department of Electrical and Computer Engineering, Drexel University(德雷塞尔大学电气与计算机工程系) Virginia Seafood Agricultural Research and Extension Center, and Department of Biological Systems Engineering, Virginia Tech(弗吉尼亚理工学院生物系统工程系和弗吉尼亚海鲜农业研究与推广中心) Amazon Store Foundation AI (SFAI)(亚马逊商店基金会人工智能(SFAI))

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO

AI总结 提出基于根部表面几何的ROG-Grasp框架,通过RGB-D感知估计农产品朝向,结合YOLO检测器和点云平面拟合生成稳定抓取姿态,在番茄和洋葱实验中实现高成功率与快速执行。

Comments Comments: 7 pages, 6 figures. Video: https://youtu.be/Ir2UtGODdMo

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14143 2026-06-02 cs.RO 83%

CLAW: A Vision-Language-Action Framework for Weight-Aware Robotic Grasping

CLAW: 一种面向重量感知机器人抓取的视觉-语言-动作框架

Zijian An, Ran Yang, Yiming Feng, Lifeng Zhou

机构 * Department of Electrical and Computer Engineering, Drexel University(德雷塞尔大学电气与计算机工程系)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO

AI总结 提出CLAW框架,通过解耦条件评估与动作生成,利用微调CLIP模型监控重量阈值并生成提示,结合流式VLA策略实现重量感知的机器人抓取,在单目标与双目标实验中优于基线模型。

Comments 8 pages, 5 figures, Video: https://youtu.be/MuMYj2QgReI

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30569 2026-06-01 cs.RO 83%

Any-ttach: Quick End-effector Swapping Enables Manipulation Dexterity with Simplicity

Any-ttach: 快速末端执行器更换实现简洁的灵巧操作

Weizhe Ni, Jinzhou Li, Haoyu Li, Cody Andres Alessio-Bunnell, Wenjing Pan, Xianyi Cheng

机构 * Department of Mechanical Engineering and Materials Science, Duke University(杜克大学机械工程与材料科学系)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出Any-ttach框架,通过低成本快速末端执行器更换机制,结合任务规划,实现多种工具和末端模块的灵巧操作,在长时任务中验证了可靠性和效率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15215 2026-06-01 cs.RO 83%

A Hierarchical Spatiotemporal Action Tokenizer for In-Context Imitation Learning in Robotics

用于机器人上下文模仿学习的层次化时空动作分词器

Fawad Javed Fateh, Ali Shah Ali, Murad Popattia, Usman Nizamani, Andrey Konin, M. Zeeshan Zia, Quoc-Huy Tran

机构 * Retrocausal, Inc.(Retrocausal公司)

专题命中 机器人操作 :robotics(title);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种层次化时空动作分词器HiST-AT,通过两级向量量化实现动作的层次化聚类,并同时利用空间和时间信息进行重建,在多个模拟和真实机器人操作基准上达到最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21013 2026-06-01 cs.RO 83%

Notes-to-Self: Scratchpad Augmented VLAs for Memory Dependent Manipulation Tasks

笔记到自我:带草稿本的增强型VLA用于依赖记忆的操作任务

Sanjay Haresh, Daniel Dijkman, Apratim Bhattacharyya, Roland Memisevic

机构 * Qualcomm AI Research(高通AI研究)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO

AI总结 本文通过在视觉-语言-动作模型中加入语言草稿本来赋予其空间和时间记忆,从而提升其在依赖记忆的长时域操作任务上的泛化能力。

Comments To appear at ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30282 2026-05-29 cs.RO 83%

Gaze2Act: Gaze-Conditioned Vision-Language-Action Policies for Interactive Robot Manipulation

Gaze2Act: 基于注视条件的视觉-语言-动作策略用于交互式机器人操作

Kuangji Zuo, Gen Li, Bofan Lyu, Yanshuo Lu, Boyu Ma, Shijia Han, Xinyu Zhou, Xichen Yuan, Chuhao Zhou, Jiaqi Bai, Geng Li, Jianfei Yang

机构 * MARS Lab, Nanyang Technological University(MARS实验室,南洋理工大学)

专题命中 机器人操作 :manipulation(title,abstract);robot learning(abstract);分类 cs.RO

AI总结 提出Gaze2Act框架,通过将人类注视作为动态意图信号,结合跨视角语义匹配和策略级条件化,实现机器人对复杂交互任务的精确操作。

Comments Project page: https://zuo-kuangji.github.io/Gaze2Act/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22771 2026-05-29 cs.CL cs.AI 83%

Reducing Political Manipulation with Consistency Training

通过一致性训练减少政治操纵

Long Phan, Devin Kim, Alexander Pan, Alice Blair, Adam Khoja, Dan Hendrycks

机构 * Center for AI Safety(人工智能安全中心) UC Berkeley(加州大学伯克利分校)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.AI

AI总结 针对大语言模型在敏感话题中表现出的隐性政治偏见,提出政治一致性训练(PCT)方法,通过情感一致性和帮助一致性两个指标及相应训练范式来减少偏见。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29378 2026-05-29 cs.RO 83%

Decentralized LLM-Driven Coordination of Acoustic Robots for Contactless Object Manipulation

去中心化LLM驱动的声学机器人协调用于非接触式物体操控

Yingying Wang, Narsimlu Kemsaram, Sriram Subramanian

机构 * Department of Computer Science, University College London(计算机科学系,伦敦大学学院) Department of Artificial Intelligence, University of Malaya(人工智能系,马来大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种去中心化框架,利用Whisper语音识别和LLM语义解析将自然语言指令转换为多机器人任务计划,实现声学机器人的非接触式物体操控,实验验证了顺序、并行和同步协作任务的有效性。

Comments This paper has been accepted for publication in the Proceedings of the 2026 IEEE 22nd International Conference on Automation Science and Engineering (CASE 2026), August 17-21, 2026, Shenyang, China

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12512 2026-05-29 cs.RO cs.SY eess.SY 83%

Practical Insights on Grasp Strategies for Mobile Manipulation in the Wild

野外移动操作抓取策略的实用见解

Isabella Huang, Richard Cheng, Sangwoon Kim, Dan Kruse, Carolyn Chen, Lukas Kaul, JC Hancock, Shanmuga Harikumar, Mark Tjersland, James Borders, Dan Helmick

机构 * Toyota Research Institute(丰田研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO

AI总结 本文通过SHOPPER移动操作机器人在真实杂货店中的部署实验,提出并分析了通用抓取策略的设计方法及数百次抓取尝试中的关键失败模式,为机器人社区提供了实用见解和待解决的关键挑战。

Comments 8 pages, 8 figures, submitted to IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28486 2026-05-28 cs.RO 83%

Mag-VLA: Vision-Language-Action Model for Bimanual Magnetically Actuated Microrobot Manipulation

Mag-VLA:用于双臂磁驱动微机器人操作的视觉-语言-动作模型

Yongchen Wang, Kangyi Lu, Lan Wei, Dandan Zhang

机构 * Department of Bioengineering, Imperial-X, Imperial College London(生物工程系,Imperial-X,帝国理工学院伦敦)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出Mag-VLA模型,利用双臂磁驱动微机器人实现灵巧操作,通过视觉-语言-动作框架和动作分块Transformer解码器,在真实机器人实验中达到90%接近成功率和最高80%运输成功率。

Comments Accepted by 2026 MARSS

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27886 2026-05-28 cs.RO 83%

Tabero: Learning Gentle Manipulation with Closed-Loop Force Feedback from Vision, Touch, and Language

Tabero: 通过视觉、触觉和语言闭环力反馈学习轻柔操作

Qiwei Wu, Rui Zhang, Xin Xiang, Tao Li, Weihua Zhang, Junjie Lai, Renjing Xu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Nvidia, Beijing, China(英伟达(北京,中国))

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 针对现有视觉-语言-动作模型缺乏触觉反馈导致无法实现轻柔操作的问题,提出Tabero基准和模型套件,通过数据高效管道生成视觉-触觉-语言任务,并采用解耦力-位置命令接口的Tabero-VTLA架构,在保持高任务成功率的同时将轻柔指令下的平均夹持力降低70%以上。

Comments Code:https://github.com/NathanWu7/Tabero

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23651 2026-05-26 cs.RO 83%

HeLoM: Hierarchical Learning for Whole-Body Loco-Manipulation by a Hexapod Robot

HeLoM: 六足机器人全身移动操作的分层学习

Xinrong Yang, Peizhuo Li, Hongyi Li, Yifeng Peng, Arhaan Jain, Junkai Lu, Linnan Chang, Yuhong Cao, Yifeng Zhang, Ge Sun, Guillaume Sartoretti

机构 * MARMoT Lab, Department of Mechanical Engineering, National University of Singapore(机械工程系,新加坡国立大学MARMoT实验室) Center for X-mechanics, Zhejiang University(浙江大学X力学中心)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出HeLoM分层框架,通过协调多肢控制实现六足机器人对重/不规则物体的稳定推动,在仿真和实物实验中验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03526 2026-05-26 cs.RO 83%

CollaBot: Vision-Language Guided Simultaneous Collaborative Manipulation

CollaBot: 视觉-语言引导的同步协作操作

Kun Song, Gaoming Chen, Shentao Ma, Ninglong Jin, Guangbao Zhao, Mingyu Ding, Zhenhua Xiong, Jia Pan

机构 * Department of Computer Science, The University of Hong Kong(香港大学计算机科学系) School of Mechanical Engineering, Shanghai Jiao Tong University(上海交通大学机械工程学院)

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO

AI总结 提出CollaBot通用框架,通过场景分割、协作抓取和两阶段规划,实现多机器人同步协作操作大型物体,在实验中达到72%成功率。

Comments 8 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏