arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-07 至 2026-07-07 共收录 140 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2607.04739 2026-07-07 cs.RO 新提交 57%

Spatial Attention: Adapting Execution Horizons for Diffusion Policies via Observation Sensitivity

空间注意力:通过观测敏感度调整扩散策略的执行范围

Che-Sang Park, Junsu Ha, Jianlong Fu, Frank C. Park

机构 * Robotics Laboratory, Seoul National University(首尔国立大学机器人实验室) Microsoft Research Asia(微软亚洲研究院)

专题命中 机器人学习 :robotic(abstract);分类 cs.RO

AI总结 研究如何在机器人学习中自适应调整采样动作块的执行范围以平衡响应性和计算成本,引入空间注意力概念,通过预测未来值动态分配执行范围,实验表明该方法可提高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 52 篇

2607.05377 2026-07-07 cs.RO cs.AI cs.CV 新提交 89%

Cortex: A Bidirectionally Aligned Embodied Agent Framework for Long-horizon Manipulation

Cortex:一种用于长视距操作的双向对齐具身智能体框架

Jiaqi Peng, Xiqian Yu, Delin Feng, Yuqiang Yang, Wenzhe Cai, Jing Xiong, Ganlin Yang, Jinliang Zheng, Jiafei Cao, Xueyuan Wei, Jiangmiao Pang, Yuan Shen, Tai Wang

机构 * Tsinghua University(清华大学) Shanghai AI Laboratory(上海人工智能实验室) Peking University(北京大学) USTC(中国科学技术大学)

专题命中 机器人操作 :embodied agent(title,abstract);manipulation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 针对现有VLA模型长视距任务短板及分层方法语义-运动鸿沟问题,提出双向对齐框架Cortex,标准化技能原语、优化数据与采样策略,提升长视距操作性能与零样本泛化能力。

Comments Project website: https://steinate.github.io/cortex.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02845 2026-07-07 cs.RO cs.AI cs.CV 新提交 89%

Differential Amplifier-Inspired AmpAttention for Multi-View Robotic Manipulation

受差分放大器启发的AmpAttention用于多视图机器人操作

Jin Yang, Ping Wei, Nanning Zheng

机构 * National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, and Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(西安交通大学人机混合增强智能技术国家级重点实验室、人工智能与机器人研究所)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 针对机器人视图图像问题,提出受模拟电路差分放大器启发的AmpAttention机制,抑制注意力噪声。基于此引入RVAF模型,提升训练效率与任务性能,还扩展为RVAF++,在高精度任务上成果显著。

Comments Accepted by IROS2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03616 2026-07-07 cs.RO 新提交 88%

ROBOCYCLE: Autonomous Dual-Arm Robotic Manipulation and Coordination for Recycling Applications

ROBOCYCLE:用于回收应用的自主双臂机器人操作与协调

Rubén de J. Hilario-Cruz, Jesus A. García-González, Enrique Coronado, Arturo E. Cerón-López

机构 * Tecnologico de Monterrey, School of Engineering and Sciences, Department of Computer Science(墨西哥蒙特雷理工大学工程学院与科学学院计算机科学系) National Institute of Advanced Industrial Science and Technology (AIST)(国家先进工业科学与技术研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 针对城市垃圾处理难题,介绍ROBOCYCLE平台,集成多视图RGB-D感知、基于变压器的实例分割及6自由度抓取规划,有效处理不规则和可变形垃圾,取得高成功率,为现实环境自主垃圾管理提供方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04234 2026-07-07 cs.RO cs.AI cs.CV 新提交 88%

SoftVTBench: A Safety-Aware Visuo-Tactile Benchmark for Physically Constrained Robotic Manipulation of Deformable Objects

SoftVTBench:用于物理约束下可变形物体机器人操作的安全感知视觉触觉基准测试

Bowen Jing, Mingxin Wang, Ruiyang Hao, Chenchen Ge, Hanwen Shen, Junjie He, Yang Cui, Yiming Hou, Weitao Zhou, Jiawei Wang, Minglei Li, Dandan Zhang, Ding Zhao, Houde Liu, Xiaofan Li, Si Liu, Ping Luo, Haibao Yu

机构 * Tuojing Intelligence(拓景智能) Tsinghua University(清华大学) King’s College London(伦敦国王学院) Southeast University(东南大学) Stevens Institute of Technology(史蒂文斯理工学院) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) University of Manchester(曼彻斯特大学) Simple AI(简单人工智能公司) Imperial College London(伦敦帝国学院) Carnegie Mellon University(卡内基梅隆大学) Zhejiang University(浙江大学) Beihang University(北京航空航天大学) The University of Hong Kong(香港大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title);分类 cs.RO、cs.AI、cs.CV

AI总结 研究物理约束下可变形物体操作,提出SoftVTBench基准测试,通过有限元模拟可变形物体,定义任务套件,分别报告目标成功和安全成功,实现基线并实验,表明仅成功评估高估策略性能,触觉传感可提升安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00678 2026-07-07 cs.CV cs.RO 新提交 87%

ABot-M0.5: Unified Mobility-and-Manipulation World Action Model

ABot-M0.5:统一移动与操作的世界动作模型

Ronghan Chen, Yandan Yang, Zuojin Tang, Dongjie Huo, Tong Lin, Haoning Wu, Haoyun Liu, Yuzhi Chen, Lulu Zheng, Botai Yuan, Tianlun Li, Mingxin Wang, Dekang Qi, Bin Hu, Wei Mei, Yuze Xuan, Haolong Yang, Yanqing Zhu, Mu Xu, Zhiheng Ma, Xinyuan Chang

机构 * AMAP CV Lab(AMAP CV实验室)

专题命中 机器人操作 :manipulation(title,abstract);navigation(abstract);world model(abstract);分类 cs.RO、cs.CV

AI总结 针对移动操作任务中VLA策略缺乏世界建模、动作空间耦合及训练-推理不一致的问题,提出ABot-M0.5模型,通过三级对齐(时间粒度、动作空间、训练-测试一致性)实现细粒度控制,在长时域任务成功率和控制精度上达到最优。

Comments Code: https://github.com/amap-cvlab/ABot-Manipulation

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04367 2026-07-07 cs.RO 新提交 86%

A Perception-Manipulation Robotics System for Food Cutting

一种用于食品切割的感知-操作机器人系统

Xinyuan Luo, Wenzhen Yuan

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 机器人操作 :manipulation(title,abstract);robotics(title);分类 cs.RO

AI总结 研究烹饪机器人切割任务,核心方法是用初步固定试验切割的力数据选刀,再用强化学习自适应切割,贡献是选刀模块成功率达100%,性能与人类相当。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02604 2026-07-07 cs.CV cs.RO 新提交 86%

DynaWM: A Base-VLA-Guided World Foundation Model for Moving-Object Manipulation

DynaWM:用于移动物体操纵的基于基础VLA的世界基础模型

Chongkei Chang, Zhidong Deng

机构 * Department of Computer Science and Technology, THUAI, Tsinghua University, Beijing 100084, China(计算机科学与技术系,THUAI,清华大学,北京100084,中国)

专题命中 机器人操作 :manipulation(title,abstract);world model(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 针对移动物体操纵挑战,提出DynaWM模型,用多种编码器提取特征,联合条件流匹配DiT生成动作轨迹,构建数据集评估,相比其他模型有性能提升,消融实验验证各部分作用。

Comments 17 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04546 2026-07-07 cs.RO cs.AI cs.CV cs.LG 新提交 85%

Mask2Real-WM: Segmentation Masks as a Sim-to-Real Bridge for Controllable Dexterous World Models

Mask2Real-WM:作为可控灵巧世界模型的模拟到现实桥梁的分割掩码

Riccardo O. Feingold, Davide Liconti, Chenyu Yang, Robert K. Katzschmann

机构 * Soft Robotic Lab, Department of Mechanical and Process Engineering ETH Zurich, Switzerland(苏黎世联邦理工学院机械与过程工程系软机器人实验室)

专题命中 机器人操作 :world model(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 提出Mask2Real-WM,一种用于灵巧操纵的两阶段动作条件世界模型,将像素预测解耦为动力学和渲染模型,利用分割空间较小的模拟到现实差距,通过合成数据预训练和真实演示微调实现各自由度动作可控。

Comments 23 pages, 24 figures, 4 tables. Preprint. Project page: https://srl-ethz.github.io/Mask2Real-WM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04927 2026-07-07 cs.RO cs.AI 新提交 84%

DSWAM: A Dual-System World Action Foundation Model for Fine-Grained Robot Manipulation

DSWAM:用于细粒度机器人操作的双系统世界行动基础模型

Jian Zhu, Jianjun Zhang, Taiyi Su, Tianbin Liu, Zhangyuan Wang, Kai Xie, Zitai Huang, Chong Ma, Youzhang He, Tianjian Wang, Hanyang Wang, Weihao Ding, Yi Xu

机构 * AIRC, Midea Group(美的集团美云智数) Tongji University(同济大学)

专题命中 机器人操作 :manipulation(title,abstract);world model(abstract);分类 cs.RO、cs.AI

AI总结 研究针对世界行动模型在复杂任务指令分解及VLA与WAM执行能力对比方面的不足,引入DSWAM,通过双系统结合,利用视觉历史和任务提示预测子任务,经多种训练及加速等实现细粒度机器人操作并进行公平对比。

Comments 13 pages, 1 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04714 2026-07-07 cs.RO cs.AI 新提交 84%

Geometry-Aware Motion Latents for Learning Robust Manipulation Policies

用于学习鲁棒操纵策略的几何感知运动潜变量

Yunchao Zhang, Yijia Weng, Ruizhe Liu, Ming Hu, Leonidas Guibas, Yanchao Yang

机构 * Department of Computer Science, The University of Hong Kong(香港大学计算机科学系)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 研究如何学习机器人操纵的运动潜变量,核心方法是通过预测点云在操纵过程中的演变来学习离散运动潜码,贡献是仅用单视图RGB-D输入达先进性能,验证几何预测是关键,且潜码有有效运动抽象能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04162 2026-07-07 cs.RO cs.LG 新提交 84%

ACE: Agentic Control for Embodied Manipulation via Zero-shot Workflow Reasoning

ACE:通过零样本工作流推理实现具身操纵的智能体控制

Iok Tong Lei, QianZhi Li, Ying Jie Yap, Yujie Zhang, Rui Zhong, Haichao Gui, Xiaolong Liu, Zhidong Deng

机构 * Department of Computer Science, Tsinghua University(清华大学计算机科学系) National College for Excellent Engineers, Beihang University(北京航空航天大学卓越工程师学院) Wuxi Dexteroushands Robotic Technology Co.(无锡灵犀机器人技术有限公司)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 研究开放式桌面操作,提出ACE零样本工作流推理框架,结合智能体工作流推理与视觉基础接口、可重复使用的拾取和放置原语等技能,经掩码介导视觉动作接口连接语义推理与物理控制,能在线适应多种情况,在复杂任务中表现出色。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04719 2026-07-07 cs.RO cs.SY eess.SY 新提交 83%

Aerial Manipulation: Contact, Medium Coupling, and the Geometry of Readiness

空中操纵:接触、介质耦合与就绪几何

Antonio Franchi

机构 * Robotics and Mechatronics lab, Faculty of Electrical Engineering, Mathematics & Computer Science, University of Twente(特温特大学电气工程、数学与计算机科学学院机器人与机电一体化实验室) Department of Computer, Control and Management Engineering, Sapienza University of Rome(罗马第一大学计算机、控制与管理工程系)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 探讨空中操纵问题,指出其与传统操纵不同,因飞行需与介质持续能量交换,各方面相互耦合。提出基于介质感知的解释,构建交互模式与能力阶梯及驱动几何观点,阐明难点、差异及未来平台作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03758 2026-07-07 cs.RO cs.CR 新提交 83%

Occluding the Solution Space: Planner-Agnostic Adversarial Attacks on Tolerance-Aware Manipulation

遮挡解空间:针对容错感知操纵的与规划器无关的对抗攻击

Keke Tang, Tianyu Hao, Weilong Peng, Hao Jiang, Feng Wu, Peican Zhu, Jianmin Ji, Zhihong Tian

机构 * Guangzhou University(广州大学) University of Science and Technology of China(中国科学技术大学) Northwestern Polytechnical University(西北工业大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出针对容错感知操纵的与规划器无关攻击框架,通过运动学占用热图刻画机器人能力,将攻击设为预算最大覆盖优化,实验表明该方法能可靠引发规划失败,优于基线。

Comments Accepted by IROS'2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03570 2026-07-07 cs.RO 新提交 83%

Cross-Embodiment Robot Manipulation via a Unified Hand Action Space

通过统一手部动作空间实现跨实体机器人操作

Luis Felipe Casas, Robert Teal, Keval Shah, Abhijit Tadepalli, Wanxin Jin, Yu Xiang

机构 * Intelligent Robotics and Vision Lab, University of Texas at Dallas(德克萨斯大学达拉斯分校智能机器人与视觉实验室) Intelligent Robotics and Interactive Systems Lab, Arizona State University(亚利桑那州立大学智能机器人与交互系统实验室)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出统一手部动作空间(UHAS)用于跨实体灵巧操作,将手部动作表示为标准球体几何变形,用级联逆运动学算法映射,经强化学习训练策略,实现跨实体零样本转移等显著收益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02819 2026-07-07 cs.CR cs.AI cs.CV 新提交 81%

Vision Token Manipulation Attacks on Cloud-Edge Inference of Large Vision-Language Models

对大型视觉语言模型云边缘推理的视觉令牌操纵攻击

Zikai Zhang, Rui Hu, Olivera Kotevska, Jiahao Xu

机构 * Department of Computer Science and Engineering, University of Nevada, Reno(内华达大学里诺分校计算机科学与工程系) Oak Ridge National Laboratory(橡树岭国家实验室)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.AI、cs.CV

AI总结 研究黑盒中间人设置下的视觉令牌操纵攻击,提出四种简答攻击策略和基于优化的令牌选择方法,实验表明操纵少量视觉令牌可大幅降低大型视觉语言模型云边缘推理的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04940 2026-07-07 cs.RO 新提交 79%

Closing the Reality Gap: Zero-Shot Sim-to-Real Deployment for Dexterous Force-Based Grasping and Manipulation

弥合现实差距:基于力的灵巧抓取与操作的零样本模拟到现实部署

Zhe Zhao, Zhibin Li, Yilin Ou, Mengshi Qi

机构 * University College London(伦敦大学学院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出一种模拟到现实的强化学习方法,利用密集触觉反馈和关节扭矩传感调控物理交互,通过快速触觉模拟、电流到扭矩校准及执行器动力学建模,实现零样本部署,展示了人类手部技能。

Comments 9 pages, 9 figures. arXiv admin note: substantial text overlap with arXiv:2601.02778

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03529 2026-07-07 cs.RO 新提交 79%

Current as Touch: Proprioceptive Contact Feedback for Compliant Dexterous Manipulation

电流即触觉:用于柔顺灵巧操作的本体感受接触反馈

Chenyang Ma, Yunchao Yao, Zhenyu Wei, Ruogu Li, Daniel Szafir, Mingyu Ding

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 研究提出基于本体感受的框架,从电机电流和关节状态学习接触感知线索,预测柔顺参考位置,兼容主流遥操作和策略学习流程,实验表明无需外部触觉或力传感器也能实现稳定柔顺抓取等。

Comments Project website: https://cat.chenyangma.com

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03321 2026-07-07 cs.RO 新提交 79%

U-Joint CAAMS: Experimental Evaluation of a Universal-Joint Continuum Manipulator for Aerial Manipulation

U型关节连续体飞行器操控臂:用于空中操控的万向节连续体操纵器的实验评估

Anuraj Uthayasooriyan, Musab Alibrahim, Krishna Manaswi Digumarti, Fernando Vanegas, Felipe Gonzalez

机构 * Queensland University of Technology (QUT)(昆士兰科技大学) QUT Centre for Robotics(昆士兰科技大学机器人中心)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 研究多旋翼无人机上连续体操纵器在操控时的问题,提出基于万向节的连续体操纵器设计,经实验评估其抗面外变形能力,还进行稳定性分析及应用演示。

Comments Accepted to International Conference on Unmanned Aircraft Systems 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03163 2026-07-07 cs.RO 新提交 79%

Beyond Point-Attached Semantics: Object-Centric Semantic Fields for Generalizable Manipulation

超越点附着语义:用于可泛化操作的以对象为中心的语义场

Zheng Sun, Lerong Zhang, Zhihao Li, Zhuo Li, Quentin Rouxel, Fei Chen

机构 * Department of Mechanical of Automation Engineering(机械与自动化工程系)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 研究可泛化机器人操作中功能对象部分的稳定3D理解问题,提出以对象为中心的连续语义场,用部分注释模型训练并冻结,实验表明该表示提供更稳定线索并提升策略性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03027 2026-07-07 cs.RO 新提交 79%

DRBA: Dynamic Robotic Balance Assistant -- An assist-as-needed gait and balance rehabilitation robot for versatile training

DRBA:动态机器人平衡辅助——一种用于多功能训练的按需辅助步态和平衡康复机器人

Yifan Wang, Li Li, Youlong Wang, Chengyuan Yang, Sherwin Stephen Chan, Jiaye Chen, Xiaoyue Yan, Hao Wang, Xuesheng Gong, Jun Lin, Hongping Hu, Wei Tech Ang

机构 * School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与航天工程学院) Guangdong Zhongxin Intelligent Rehabilitation Research Institute(广东众心智能康复研究院) Guangdong Jianxiang Hospital Group(广东健翔医院集团)

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO

AI总结 针对现有地面机器人步态训练器的局限,提出动态机器人平衡辅助(DRBA),集成多种部件与算法,能按需提供体重和平衡支持,实验及患者试验验证其有效性,可提升康复效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02638 2026-07-07 cs.CV q-bio.QM 新提交 79%

CLABTOOLKIT: An Open-Source Toolkit for Routine Processing, Manipulation, and Visualization of Neuroimaging Data

CLABTOOLKIT:用于神经影像数据常规处理、操作和可视化的开源工具包

Yasser Alemán-Gómez, Nino Hervé, Patric Hagmann

机构 * Connectomics Lab, Department of Radiology, Lausanne University Hospital (CHUV)(洛桑大学医院(CHUV)放射科连接组学实验室) University of Lausanne (UNIL)(洛桑大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.CV

AI总结 神经影像研究面临数据结构多样、工具接口和格式不兼容问题。CLABTOOLKIT将相关操作整合为统一框架,核心数据结构可处理多种格式数据,还有多个模块支持多种分析及可视化,其配置系统方便定制工作流程。

Comments Presented at OHBM 2026 in Bordeaux, France. Submitted to Aperture Neuro

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01051 2026-07-07 cs.RO 新提交 79%

AutoSpeed: Annotation-Free Stage-Adaptive Motion Speed Learning for Robot Manipulation

AutoSpeed:面向机器人操作的无标注阶段自适应运动速度学习

Qingda Hu, Ziheng Qiu, Jieru Zhao, Zhongxue Gan, Wenchao Ding

机构 * Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出AutoSpeed框架,通过频域速度调制和复合代价优化,使视觉运动策略能根据任务阶段自适应调整执行速度,减少执行时间并提高成功率。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05141 2026-07-07 q-fin.CP econ.TH nlin.AO q-fin.TR 新提交 78%

Square-Root Price Impact Is Necessary for Endogenous Manipulation Cycles in Learning-Agent Markets

平方根价格影响对于学习型代理市场中内生操纵周期是必要的

Yang Zhou, Jianwen Chen, Ruipeng Wei

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 研究单个进化优化的机构代理与众多散户交易者互动的市场,机构代理发现多周期掠夺策略。通过平均场约化映射系统,揭示平方根价格影响的必要性,其是市场非线性动力学系统最优控制解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04426 2026-07-07 cs.RO 新提交 77%

ACE-Brain-0.5: A Unified Embodied Foundational Model for Physical Agentic AI

ACE-Brain-0.5:用于物理智能体人工智能的统一具身基础模型

Brain Team, Ziyang Gong, Haoming Gu, Zehang Luo, Tianyi Zhang, Tao Tao, Yixiao Chi, Zhe Liu, Lingsi Zhu, Jingyuan Liu, Anke Tang, Songze Li, Yilun Kong, Ningjing Liu, Tianyu Zhu, Yunpeng Qing, Shuang Luo, Xiang Liu, Shi Fu, Dawei Nie, Sixiang Liu, Zhexi Wen, Feng Pan, Xiaofeng Wang, Zhi Hou, Chunxiao Liu, Xue Yang, Junchi Yan, Hengshuang Zhao, Dacheng Tao, Xiaogang Wang

机构 * ACE-Brain Team(ACE-Brain团队)

专题命中 机器人操作 :embodied AI(abstract);manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 研究针对具身人工智能从模块向物理智能体发展的问题,提出ACE-Brain-0.5统一基础模型,通过耦合的五个功能及SSR+等方法,提升空间感知等能力,在多基准测试中有进步。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30988 2026-07-07 cs.RO 新提交 77%

Multisensory Continual Learning: Adapting Pretrained Visuomotor Policies to Force

多感官持续学习:将预训练的视觉运动策略适应到力觉

Jaden Clark, Changhao Wang, Yihuai Gao, Seongheon Hong, Hojung Choi, Mark Cutkosky, Yifan Hou, Shuran Song

机构 * Stanford University(斯坦福大学)

专题命中 机器人操作 :manipulation(abstract);world model(abstract);robot policy(abstract);分类 cs.RO

AI总结 提出MuSe方法,通过多阶段融合、多感官未来预测和预训练数据经验回放,将有限的多感官数据融入预训练的纯视觉策略,在保持原始任务性能的同时适应新任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04591 2026-07-07 cs.RO cs.AI 新提交 73%

Simple-to-Complex Structured Demonstrations for Vision-Language-Action Learning

用于视觉-语言-动作学习的从简单到复杂的结构化演示

Xinchuan Qiu, Yi Yu

机构 * Graduate School of Advanced Science and Engineering, Hiroshima University(广岛大学先进科学与工程研究生院)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 研究视觉-语言-动作模型中演示的收集与组织问题,提出用双臂机器人平台的从简单到复杂结构化演示收集策略,依三原则组织数据,提升了学习效率与稳定性。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03865 2026-07-07 cs.RO cs.AI 新提交 73%

High-Fidelity One-Step Generative Visuomotor Policy via Recursive Correction, Frequency Consistency, and Contrastive Flow Matching

通过递归校正、频率一致性和对比流匹配实现高保真一步生成视觉运动策略

Yuran Chen, Xinye Cai, Zhonglin Gong, Yang Huang

机构 * School of Safety Science and Engineering, Anhui University of Science and Technology(安徽理工大学安全科学与工程学院) State Key Laboratory of Digital Intelligent Technology for Unmanned Coal Mining, Anhui University of Science and Technology(安徽理工大学煤矿智能开采技术与装备国家重点实验室) School of Artificial Intelligence, Anhui University of Science and Technology(安徽理工大学人工智能学院)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 研究针对生成模型多步采样有延迟、一步加速方法有偏差等问题,提出含递归校正、频率一致性和对比流匹配三机制的框架,解决相关问题,实验显示该方法在低延迟下性能优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03449 2026-07-07 cs.RO cs.AI 新提交 73%

HiMe: Hierarchical Embodied Memory for Long-Horizon Vision-Language-Action Control

HiMe:用于长距离视觉-语言-动作控制的分层具身记忆

Li Ji, Siyin Wang, Pengfang Qian, Xiaopeng Yu, Yihai Tian, Zhaoye Fei, Jingjing Gong, Xipeng Qiu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) East China Normal University(华东师范大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 针对视觉-语言-动作模型处理非马尔可夫任务的不足,提出HiMe分层具身记忆框架,解耦智能为高频执行器等,引入动态知识系统,平衡实时执行与思考规划冲突,提升长距离任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02549 2026-07-07 cs.CV cs.RO 新提交 73%

Learning 3D Affordances for Blade Insertion in Cluttered Stowing

学习在杂乱收纳中进行刀片插入的3D可用空间

Tianyu Li, Harpreet Sawhney, Minju Jung, Aditya Mehrotra, Kunal Mehrotra, Mudit Agrawal

机构 * Amazon Robotics(亚马逊机器人公司)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 研究杂乱收纳中刀片插入的3D可用空间问题,利用VulcanVoxel方法,通过基于3D占用场的掩码自动编码器,从单峰数据恢复多模态预测,提升了性能。

详情

展开后加载摘要…

URL PDF HTML 收藏