arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-24 至 2026-06-24 共收录 25 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 25 篇

2606.24742 2026-06-24 cs.RO 新提交 89%

World Value Models for Robotic Manipulation

机器人操作的世界价值模型

Zhihao Wang, Jianxiong Li, Yu Cui, Yuan Gao, Xianyuan Zhan, Junzhi Yu, Xiao Ma

机构 * Peking University(北京大学) Tsinghua University(清华大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);world model(abstract);分类 cs.RO

AI总结 提出世界价值模型(WVM),融合世界模型与价值估计,通过时序建模评估数据质量,在标准基准和次优轨迹基准上达到SOTA,提升策略学习性能。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18375 2026-06-24 cs.RO 新提交 89%

PAIWorld: A 3D-Consistent World Foundation Model for Robotic Manipulation

PAIWorld: 用于机器人操作的三维一致世界基础模型

Yuhang Huang, Xuan Lv, Junyan Xu, Zhiyuan Yu, Jiazhao Zhang, Ruizhen Hu, Wancheng Feng, Shilong Zou, Hewen Xiao, Ziqiao Zhou, Kaiyun Huang, Zhiyu Peng, Juzhan Xu, Hang Zhao, Chenyang Zhu, Renjiao Yi, Yifei Huang, Douhui Wu, Yan Zhang, Kexu Cheng, Chunhe Song, Yunzhi Xue, Xiuhong Zhang, Leitao Guo, Yunji Chen, Bin Wu, Haibin Yu, Kai Xu

机构 * Institute of AI for Industries, Chinese Academy of Sciences(中国科学院人工智能产业研究院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);world model(abstract);分类 cs.RO

AI总结 提出PAIWorld框架,通过几何感知交叉注意力、几何旋转位置编码和潜在3D-REPA蒸馏,解决多视图世界模型的3D不一致问题,在机器人操作基准上取得领先性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00324 2026-06-24 cs.RO cs.CV cs.HC 版本更新 88%

MILE: A Mechanically Isomorphic Hand Exoskeleton and Visuotactile Robotic Hand for Data Collection in Dexterous Manipulation

MILE:一种用于灵巧操作的指尖视觉触觉传感的机械同构外骨骼数据采集系统

Jinda Du, Jieji Ren, Qiaojun Yu, Ningbin Zhang, Yu Deng, Xingyu Wei, Yufei Liu, Guoying Gu, Xiangyang Zhu

机构 * State Key Laboratory of Mechanical System and Vibration, School of Mechanical Engineering, Shanghai Jiao Tong University, Shanghai 200240, China(机械系统与振动国家重点实验室,上海交通大学机械工程学院,上海200240,中国) Shanghai Key Laboratory of Intelligent Robotics, Shanghai Jiao Tong University, Shanghai 200240, China(智能机器人上海重点实验室,上海交通大学,上海200240,中国) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室,上海,中国) Humanoid Robot (Shanghai) Co., Ltd., Shanghai, China(上海人形机器人有限公司,上海,中国)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.CV

AI总结 针对现有灵巧操作数据采集系统运动重定向不准确、效率低、缺乏高分辨率指尖触觉传感的问题,提出MILE系统,通过从人手到外骨骼再到机械手的机械同构设计,实现无重定向精确控制,并集成指尖视觉触觉模块,采集多模态数据集,显著提升遥操作成功率。

Comments 18 pages including supplementary material. Main manuscript and supplementary material included in this version

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05226 2026-06-24 cs.RO cs.AI 版本更新 88%

Reward-Centered ReST-MCTS: A Robust Decision-Making Framework for Robotic Manipulation in High Uncertainty Environments

以奖励为中心的ReST-MCTS:高不确定性环境下机器人操作的鲁棒决策框架

Xibai Wang

机构 * Xibai Wang(王西拜)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.AI

AI总结 提出Reward-Centered ReST-MCTS框架,通过分解中间反馈为中心信号并引导搜索,解决高不确定性环境下MCTS因稀疏奖励和噪声导致的决策脆弱性问题,实验验证其在同骨干VLA上的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22136 2026-06-24 cs.RO 新提交 88%

Wh0: Generative World Models as Scalable Sources of Egocentric Human Hand Manipulation Data

Wh0: 生成式世界模型作为自我中心人类手部操作数据的可扩展来源

Yangtao Chen, Zixuan Chen, Peiyang Wang, Yong-Lu Li, Jing Huo, Jieqi Shi, Yang Gao

机构 * Shanghai Innovation Institute(上海创新研究院) Nanjing University(南京大学) Shanghai Jiaotong University(上海交通大学)

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);分类 cs.RO

AI总结 提出Wh0框架,利用生成式视频世界模型产生自我中心人-物交互数据集WM-H,通过手部运动重建和视觉编辑转化为机器人可训练监督,提升预训练灵巧VLA模型在真实任务上的零样本成功率。

Comments Under review. The first three authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24466 2026-06-24 cs.RO 新提交 83%

FT-WBC: Learning Fault-Tolerant Whole-Body Control for Legged Loco-Manipulation

FT-WBC:学习腿式操作任务的容错全身控制

Yudong Zhong, Pengfei Mai, Sikai Guo, Jiahang Cao, Zhihai Bi, Qiuyue Liu, Ziyan Feng, Jinni Zhou, Jun Ma

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The University of Hong Kong(香港大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 针对腿式机械臂在致动器故障下易失稳的问题,提出FT-WBC框架,通过故障估计器和姿态适应模块实现容错全身控制,提升生存率和操作空间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23090 2026-06-24 cs.RO 新提交 83%

Flow as Flow: Modeling Robot Velocity Fields as Probability Velocity Fields for Flow-Based Object Manipulation

Flow as Flow:将机器人速度场建模为概率速度场用于基于流的物体操作

Koki Seno, Daichi Yashima, Yusuke Takagi, Kento Tokura, Komei Sugiura

机构 * Keio University(庆应义塾大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出Flow as Flow框架,将机器人速度场建模为概率流,基于流匹配公式实现高效高质量的机器人流生成,在标准基准和真实世界实验中优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10807 2026-06-24 cs.RO 83%

Bridging Language and Action: A Survey of Language-Conditioned Robot Manipulation

连接语言与行动:语言引导的机器人操作综述

Xiangtong Yao, Hongkuan Zhou, Oier Mees, Yuan Meng, Ted Xiao, Yonatan Bisk, Jean Oh, Edward Johns, Mohit Shridhar, Dhruv Shah, Jesse Thomason, Kai Huang, Joyce Chai, Zhenshan Bing, Alois Knoll

机构 * Technical University of Munich(慕尼黑技术大学) Corporate Research, Robert Bosch GmbH(罗伯特·博世集团企业研究部) University of California Berkeley(加州大学伯克利分校) Microsoft(微软) Google DeepMind(谷歌DeepMind) Carnegie Mellon University(卡内基梅隆大学) Imperial College London(伦敦帝国理工学院) Princeton University(普林斯顿大学) University of Southern California(南加州大学) Sun Yat-sen University(中山大学) University of Michigan(密歇根大学) Institute for Artificial Intelligence, University of Stuttgart(斯图加特大学人工智能研究所) The State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文综述了语言引导的机器人操作领域,探讨了语言如何与机器人系统整合,分析了现有方法的分类及最新进展,指出关键争议和未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21916 2026-06-24 cs.RO 版本更新 83%

Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials

Prior Reinforce: 有限试验下的目标条件动态操控

Yihang Hu, Pingyue Sheng, Yuyang Liu, Shengjie Wang, Yang Gao

机构 * IIIS, Tsinghua University(清华大学智能学院) Shanghai Qi Zhi Institute(上海启智研究院) Spirit AI

专题命中 机器人操作 :manipulation(title,abstract);robotics(abstract);分类 cs.RO

AI总结 提出Prior Reinforce框架,利用条件扩散模型从少量演示学习运动流形,并在低维条件空间通过反馈驱动优化适应新目标,实现少至十次试验内的动态操控。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24450 2026-06-24 cs.RO cs.AI 新提交 81%

NoContactNoWorries: Estimating Contact through Vision and Proprioception for In-Hand Dexterous Manipulation

NoContactNoWorries: 通过视觉和本体感觉估计手内灵巧操作的接触

Soham Patil, Avirup Das, Sourabh Bhosale, Spandan Roy

机构 * Robotics Research Center (RRC), International Institute of Information Technology (IIIT), Hyderabad, India(印度海得拉巴国际信息技术研究所机器人研究中心) Department of Computer Science, The University of Manchester(曼彻斯特大学计算机科学系)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI

AI总结 提出一种基于Transformer的多模态框架,融合RGB-D视觉和机器人本体感觉推断二值接触状态,作为手物交互的伪触觉信号,支持下游强化学习实现手内物体重定向并泛化至新物体。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems(IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24403 2026-06-24 cs.RO cs.LG 新提交 81%

RE4: Transformation-aware Imitation of Object Interactions Using Manipulation Modes

RE4: 使用操作模式进行物体交互的变换感知模仿

Arsh Chawla, Rahul Shome

机构 * Australian National University(澳大利亚国立大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.LG

AI总结 提出RE4框架,通过轻量级自监督姿态估计和操作模式感知的检索、变换、重规划与执行,在保持可解释性的同时提升物体交互模仿学习的性能和鲁棒性。

Comments 8 pages, appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24628 2026-06-24 cs.RO cs.CV 新提交 80%

ArtiTwinSplat: Interactable Digital Twin Reconstruction via Gaussian Splatting from RGB-D videos

ArtiTwinSplat:基于RGB-D视频的高斯泼溅实现可交互数字孪生重建

Pranjal Mishra, René Zurbrügg, Max Wilder-Smith, Marco Hutter, Marc Pollefeys, Zuria Bauer, Hermann Blum

机构 * ETH Zürich(苏黎世联邦理工学院) Microsoft(微软) University of Bonn(波恩大学)

专题命中 机器人操作 :robotic(abstract,comments);embodied AI(abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 提出ArtiTwinSplat框架,利用3D高斯泼溅从RGB-D视频自动构建可交互的铰接物体数字孪生,无需CAD模型或人工标注,支持实时渲染与交互操作。

Comments Presented at the ICRA 2026 Workshop on Advances and Challenges in AI-Driven Automation and Robotic System Integration with Digital Twins, Vienna, June 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24552 2026-06-24 cs.RO 新提交 79%

Enabling Robust Cloth Manipulation via Inference-Time Simulator-in-the-Loop Refinement

通过推理时仿真器在环优化实现鲁棒的布料操作

Xin Liu, Yulin Li, Ziming Li, Pengyu Jing, Zhenhao Huang, Bingyang Zhou, Ziqiu Zeng, Siyuan Luo, Chenkun Qi, Fan Shi

机构 * National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出基于仿真器在环优化的布料操作框架,通过合成数据训练的真实到仿真模块和稀疏网格滚动结合先验引导MPPI,从单RGB输入实现鲁棒操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16821 2026-06-24 cs.CL cs.CR cs.CY cs.IR 新提交 78%

How Much Can We Trust LLM Search Agents? Measuring Endorsement Vulnerability to Web Content Manipulation

我们能在多大程度上信任LLM搜索智能体?衡量对网络内容操纵的认可脆弱性

Yimeng Chen, Zhe Ren, Firas Laakom, Yu Li, Dandan Guo, Jürgen Schmidhuber

机构 * Center of Excellence for Generative AI, KAUST(KAUST生成式人工智能卓越中心) Jilin University(吉林大学) Zhejiang University(浙江大学) The Swiss AI Lab, IDSIA-USI/SUPSI(瑞士人工智能实验室 IDSIA-USI/SUPSI) NNAISENSE

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 提出SearchGEO框架,通过五类攻击模式和输出级指标评估13种LLM后端对网络内容操纵的认可脆弱性,发现攻击成功率从0%到31.4%不等,且不同后端对攻击模式的敏感性和部署框架的影响存在显著差异。

Comments 23 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12329 2026-06-24 cond-mat.mtrl-sci cond-mat.mes-hall 78%

Building unconventional magnetic phases on graphene by H atom manipulation: From altermagnets to Lieb ferrimagnets

通过氢原子操控在石墨烯上构建非常规磁相:从交替磁体到李贝反铁磁体

B. Viña-Bausá, M. A. García-Blázquez, S. Chourasia, R. Carrasco, D. Expósito, I. Brihuega, J. J. Palacios

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 通过单个氢原子操控,在石墨烯上实现所有非相对论磁相,包括顺磁性、铁磁性、反铁磁性、反铁磁性、交替磁性等,利用扫描隧道显微镜验证,并通过密度泛函理论和Hubbard平均场计算确认其磁性特征。

Comments 4 figures, 8 supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17070 2026-06-24 cs.RO cs.AI 版本更新 73%

MuTRAP: Multi-trigger Trojans Attacking Robot Task Planning Systems

MuTRAP: 攻击机器人任务规划系统的多触发器木马

Mohaiminul Al Nahian, Zainab Altaweel, David Reitano, Sabbir Ahmed, Shiqi Zhang, Adnan Siraj Rakin

机构 * Binghamton University (SUNY)(宾夕法尼亚州立大学布林顿分校)

专题命中 机器人操作 :robotics(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 提出首个针对LLM辅助机器人任务规划器的多触发器木马攻击MuTRAP,通过少量任务特定参数注入后门,并优化触发器词以激活特定恶意行为,揭示当前基于LLM的规划器的安全漏洞。

Comments Accepted for publication at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22923 2026-06-24 cs.RO 新提交 70%

PanoVine: Whole-Body Visuomotor Control for Soft Growing Vine Robot

PanoVine: 软体生长藤蔓机器人的全身视觉运动控制

Yimeng Qin, Xiaomeng Xu, William Heap, Aditi Oak, Shuran Song, Allison Okamura

机构 * Stanford University(斯坦福大学)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 针对软体生长藤蔓机器人难以建模和控制的问题,提出基于全身视觉反馈的数据驱动控制框架,利用19个分布式相机和端到端策略实现复杂环境下的自主导航与操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00814 2026-06-24 cs.RO 版本更新 70%

RTFF: Random-to-Target Fabric Flattening Policy using Dual-Arm Manipulator

RTFF:使用双臂机械手的随机到目标织物展平策略

Kai Tang, Dipankar Bhattacharya, Hang Xu, Fuyuki Tokuda, Norman C. Tien, Kazuhiro Kosuge

机构 * Department of Electrical and Electronic Engineering, Faculty of Engineering, The University of Hong Kong(香港大学电子与电气工程系) Dyson School of Design Engineering, Imperial College London(帝国理工学院设计工程学院) Unprecedented-scale Data Analytics Center, Tohoku University(东北大学大规模数据分析中心) Graduate School of Information Sciences, Tohoku University(东北大学信息科学研究生院) Department of Mechanical Engineering, City University of Hong Kong(香港城市大学机械工程系)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出随机到目标织物展平任务,通过模板网格对齐和混合模仿学习-视觉伺服策略,实现双臂机器人对任意目标姿态的织物展平与对齐。

Comments 8 pages, 7 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12120 2026-06-24 cs.RO cs.AI cs.CV 版本更新 67%

CRAFT: A Tendon-Driven Hand with Hybrid Hard-Soft Compliance

CRAFT: 一种具有混合硬-软柔顺性的腱驱动手

Leo Lin, Shivansh Patel, Jay Moon, Svetlana Lazebnik, Unnat Jain

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) UC Irvine(uci)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 提出CRAFT手,一种腱驱动拟人手,通过关节软材料与连杆刚性结合实现混合柔顺性,在接触丰富操作中提升强度、耐久性和抓取能力,覆盖Feix分类全部33种抓取。

Comments In RSS 2026. Website: https://roboticsconference.org/program/papers/192/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24208 2026-06-24 cs.RO 新提交 57%

Grounding Generative Policies in Physics: Optimization-Guided Diffusion for Robot Control

将生成式策略基于物理:面向机器人控制的优化引导扩散

Sabrina Bodmer, René Zurbrügg, Tifanny Portela, Hao Ma, Alexandre Didier, Marco Hutter, Colin Jones, Melanie Zeilinger

机构 * ETH Zurich(苏黎世联邦理工学院) EPFL(洛桑联邦理工学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 提出推理时优化框架,通过将扩散引导建模为约束优化问题,在采样中施加物理可行性约束,无需重训练即可提升机器人任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24057 2026-06-24 cs.CV 新提交 57%

EPEdit: Redefining Image Editing with Generative AI and User-Centric Design

EPEdit: 用生成式AI和以用户为中心的设计重新定义图像编辑

Hoang-Phuc Nguyen, Dinh-Khoi Vo, Trong-Le Do, Hai-Dang Nguyen, Tan-Cong Nguyen, Vinh-Tiep Nguyen, Tam V. Nguyen, Khanh-Duy Le, Minh-Triet Tran, Trung-Nghia Le

机构 * University of Science, VNU-HCM(越南胡志明市科学大学) Vietnam National University, Ho Chi Minh City(越南国家大学,胡志明市) University of Information Technology, VNU-HCM(越南胡志明市信息科技大学) University of Dayton(Dayton 大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 提出EPEdit应用,结合零样本Stable Diffusion模型和用户友好界面,支持多种图像编辑任务,无需微调,性能优于现有方案。

Comments SOICT 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04560 2026-06-24 cs.RO 版本更新 57%

From Local Corrections to Generalized Skills: Improving Neuro-Symbolic Policies with MEMO

从局部修正到通用技能:利用MEMO改进神经符号策略

Benjamin A. Christie, Yinlong Dai, Mohammad Bararjanianbahnamiri, Simon Stepputtis, Dylan P. Losey

机构 * Collab Dept. of Mechanical Engineering, Virginia Tech, Blacksburg, USA.(机械工程系,弗吉尼亚理工学院,黑斯堡,美国) TEA Lab(TEA实验室)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 针对机器人神经符号策略中技能不足的问题,提出MEMO框架,通过收集、聚类和改写多用户自然语言修正,构建检索增强的技能手册,动态扩展技能库,实现新任务泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24676 2026-06-24 physics.atom-ph physics.optics quant-ph 新提交 50%

Nonlinear refractive index of warm rubidium vapor

温铷蒸气的非线性折射率

L. Kardum, G. Premec, N. Šantić, D. Aumiler

专题命中 机器人操作 :manipulation(abstract)

AI总结 基于光学布洛赫方程计算温铷蒸气的线性和非线性折射率,与干涉测量实验定量吻合,获得高达10^{-4} cm^2/W的Kerr非线性折射率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01822 2026-06-24 cs.CR cs.CY 50%

Firewalls to Secure Dynamic LLM Agentic Networks

为动态LLM代理网络设计防火墙

Sahar Abdelnabi, Amr Gomaa, Eugene Bagdasarian, Per Ola Kristensson, Reza Shokri

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出双防火墙架构,通过任务上下文投影过滤通信内容,有效降低隐私和安全攻击成功率,同时保持任务完成质量。

Comments TMLR 2026. Our code and transcripts can be found at: https://github.com/amrgomaaelhady/Firewall-Agentic-Networks

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03241 2026-06-24 physics.atom-ph physics.optics 50%

Atom Camera: Super-resolution scanning microscope of a light pattern with a single ultracold atom

原子相机:利用单个超冷原子作为探针的光图案超分辨率扫描显微镜

Takafumi Tomita, Yuki Torii Chew, Rene Villela, Tirumalasetty Panduranga Mahesh, Hiroto Sakai, Keisuke Nishimura, Taro Ando, Sylvain de Léséleuc, Kenji Ohmori

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出一种利用单个超冷原子作为探针的原子相机技术,实现光图案的高分辨率二维成像,通过原子位置的亚微米步进扫描和自旋态能量变化检测,实现了对光场的高灵敏度成像,包括强度和偏振度。

详情

展开后加载摘要…

URL PDF HTML 收藏