arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-02 至 2026-07-02 共收录 60 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 17 篇

2607.01067 2026-07-02 cs.RO cs.CV 新提交 88%

Human-Centric Transferable Tactile Pre-Training for Dexterous Robotic Manipulation

面向灵巧机器人操作的人为中心的可迁移触觉预训练

Chi Zhang, Penglin Cai, Ziheng Xi, Haoqi Yuan, Hao Luo, Wanpeng Zhang, Sipeng Zheng, Chaoyi Xu, Zongqing Lu

机构 * Peking University(北京大学) BeingBeyond Tsinghua University(清华大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.CV

AI总结 提出H-Tac大规模触觉-动作数据集和可迁移触觉预训练(TTP)系统,通过统一触觉与动作空间弥合人机差距,利用触觉专家预测未来触觉以建模接触动力学,显著提升灵巧操作的泛化与精细控制能力。

Comments The first two authors contribute equally. Orders are decided by flipping a coin

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00031 2026-07-02 cs.RO 新提交 86%

Joint Discovery of Object and Action Symbols through Effect Prediction for Robotic Manipulation Planning

通过效应预测联合发现物体与动作符号以进行机器人操作规划

Burcu Kilic, Berke Kartal, Fatih Dogangun, Erhan Oztop, Emre Ugur

机构 * Bogazici University(博阿齐奇大学) Ozyegin University(厄兹耶金大学) Osaka University(大阪大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title);分类 cs.RO

AI总结 提出一种通过二元瓶颈层联合发现操作原语和物体类别的方法,利用预测多模态交互效应进行离散规划,在桌面重定位和堆叠任务中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31037 2026-07-02 cs.RO 新提交 83%

Labimus: A Simulation and Benchmark for Humanoid Dexterous Manipulation in Chemical Laboratory

Labimus: 化学实验室中类人灵巧操作的仿真与基准

Yuhan Wu, Zhao Jin, Tao Li, Yuheng Zhang, Zhichao Wang, Shuo Wang, Jun Jiang, Xiaobo Li, Yanyong Zhang, Jian Tang, Zhengping Che, Yan Xia

机构 * University of Science and Technology of China(中国科学技术大学) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出Labimus,首个针对有机化学实验室中类人灵巧操作的基准,通过真实到仿真建模重建30多个功能资产,定义原子操作和称重流程,揭示任务完成与实验精度之间的差距。

Comments Project page: https://labimus.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00424 2026-07-02 cs.RO cs.SY eess.SY 新提交 79%

Robust Operational Space Control with Conformal Disturbance Bounds for Safe Redundant Manipulation

具有共形扰动边界的鲁棒操作空间控制用于安全冗余操作

Wenhua Liu, Fan Zhang, Qin Lin

机构 * Department of Engineering Technology and the Department of Electrical and Computer Engineering, University of Houston(工程科技系和电气与计算机工程系,休斯顿大学)

专题命中 机器人操作 :manipulation(title);robotic(abstract);分类 cs.RO

AI总结 提出结合扩展状态观测器和共形预测的鲁棒操作空间控制框架,在动态不确定性下实现冗余机械臂的精确任务空间跟踪与安全保证。

Comments Paper accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00889 2026-07-02 cs.CV cs.AI 新提交 79%

DeWorldSG: Depth-Aware 3D Semantic Scene Graph Generation via World-Model Priors

DeWorldSG: 基于世界模型先验的深度感知3D语义场景图生成

Seok-Young Kim, Abdelrahman Elskhawy, Taewook Ha, Dooyoung Kim, Eunjae Shin, Benjamin Busam, Woontack Woo

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) La Trobe University(拉筹伯大学)

专题命中 机器人操作 :manipulation(abstract);world model(abstract);robotic(abstract);分类 cs.AI、cs.CV

AI总结 提出DeWorldSG框架,通过深度引导滤波估计实例级3D高斯分布,并利用世界模型先验聚合时空证据,生成时空鲁棒的3D语义场景图,在对象和谓词预测上达到最先进性能。

Comments 19 pages, 6 figures, ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00758 2026-07-02 cs.GT 新提交 78%

Which Voting Rules Are More Resilient to Coalitional Manipulation?

哪些投票规则对联盟操纵更具韧性?

François Durand

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 通过一个仅捕捉一种偏好排序优势程度的极简模型,预测了所有标准序数投票规则在扰动文化模型下的脆弱性,发现了基于Condorcet赢家新概念的规则族,并在真实数据集上验证了其预测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00530 2026-07-02 cs.RO cs.AI 新提交 73%

From Technical Metrics to User Perception: A User Study of a Multimodal Human-Robot Interaction System for Object Detection and Grasping

从技术指标到用户感知:面向物体检测与抓取的多模态人机交互系统用户研究

Jian Song, Tian Zi, Shen Guanting

机构 * Dalian University of Technology(大连理工大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 通过24名用户的受试内实验,验证了端到端任务成功率从75%提升至90%的技术改进能显著提升用户对速度、可靠性和整体能力的感知,且70.83%的用户偏好改进系统。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30900 2026-07-02 cs.RO 新提交 70%

The Quadruped Soft Tail: Compliant Grasping and Swabbing for Contamination Surveys in Harsh Environments

四足软尾巴:用于恶劣环境中污染调查的柔顺抓取与擦拭

Harald Minde Hansen, Nandita Gallacher, Kristin Y. Pettersen, Jan Tommy Gravdahl, Mario di Castro

机构 * Mechatronics, Robotics and Operation Section, European Organization for Nuclear Research (CERN)(欧洲核子研究中心(CERN)机电一体化、机器人与操作部门) Department of Engineering Cybernetics, Norwegian University of Science and Technology (NTNU)(挪威科技大学(NTNU)工程控制论系)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种安装在四足机器人上的轻量、柔软、肌腱驱动的尾巴,通过空心柔性骨架和软体夹爪实现污染拭子的抓取、擦拭和回收,结合运动学模型和任务空间控制器实现遥操作,验证了抓取对形状影响小且共模驱动可调节刚度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01212 2026-07-02 cs.RO cs.AI 新提交 62%

FurnitureVLA: Learning Long-Horizon Bimanual Furniture Assembly with Vision-Language-Action Model

FurnitureVLA: 使用视觉-语言-动作模型学习长时域双臂家具组装

Chenyang Ma, Yue Yang, Radu Corcodel, Siddarth Jain, Andrew Wu, Chiori Hori, Diego Romeres

机构 * Mitsubishi Electric Research Laboratories(三菱电机研究实验室) University of Oxford(牛津大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.AI

AI总结 提出FurnitureVLA,首个使用视觉-语言-动作模型进行真实尺寸双臂家具组装的系统,通过进度增强VLA和设计因素研究,将平均模拟成功率从48%提升至80%。

Comments Project Page: https://dannymcy.github.io/furniturevla/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00174 2026-07-02 cs.CV cs.LG 新提交 62%

Steal the Patch Size: Adversarially Manipulate Vision-Language Models

窃取补丁大小:对抗性操纵视觉-语言模型

Kai Hu, Akash Bharadwaj, Weichen Yu, Matt Fredrikson

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV、cs.LG

AI总结 提出一种黑盒模型窃取攻击,通过任务级侧信道推断视觉语言模型的补丁大小和预处理流程,并利用泄露信息实现预处理感知的迁移攻击和模型定向对抗操纵。

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00334 2026-07-02 cs.AI 新提交 57%

Managed Autonomy at Runtime: Gear-Based Safety and Governance for Single- and Multi-Agent Cyber-Physical Systems

运行时管理自主性:基于档位的单/多智能体信息物理系统安全与治理

Srini Ramaswamy, Wang Miaosheng

机构 * DNRS.ai, USA

专题命中 机器人操作 :robotic(abstract);分类 cs.AI

AI总结 提出一种离散时间控制系统,通过五个执行档位和效用门控调度,在单智能体场景中证明单调稳定性、执行安全性和最终稳定,在多智能体CPS中结合治理状态实现分布式安全保证,在UR5机器人装配单元上达到99.6%异常检测率。

Comments to be submitted to a Journal, 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00326 2026-07-02 cs.RO 新提交 57%

NeHMO: Neural Hamilton-Jacobi Reachability Learning for Decentralized Safe Multi-Arm Motion Planning

NeHMO:面向分散式安全多臂运动规划的神经哈密顿-雅可比可达性学习

Qingyi Chen, Zachary Kingston, Ahmed H. Qureshi

机构 * Department of Computer Science at Purdue University(普渡大学计算机科学系)

专题命中 机器人操作 :robotics(abstract);分类 cs.RO

AI总结 提出基于神经哈密顿-雅可比可达性学习的方法,学习安全值函数以捕获最坏情况下的臂间安全约束,并开发分散式轨迹优化框架,实现可扩展、数据高效且泛化能力强的实时多臂运动规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00001 2026-07-02 cs.AI cs.CY 新提交 57%

Constructive Alignment: Governing Preference Dynamics in Human-AI Interaction

建构性对齐:人机交互中的偏好动态治理

Max Kanwal, Caryn Tran

机构 * Stanford University(斯坦福大学) Northwestern University(西北大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 提出建构性对齐范式,将对齐问题重构为控制人类偏好轨迹演化的控制问题,而非静态偏好满足,通过控制论框架确保价值轨迹的连贯性与反思性。

Comments 23 pages, 1 figure; Proceedings of the AAAI-26 Workshop on Machine Ethics

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00854 2026-07-02 cs.SI cs.CY cs.HC 新提交 50%

A field experiment of social influence and behavioral contagion with bots on Reddit

Reddit上社会影响与行为传染的实地实验:机器人的作用

Hiroki Oda, Kinga Makovi, Taha Yasseri, Milena Tsvetkova

专题命中 机器人操作 :manipulation(abstract)

AI总结 通过在Reddit进行实地实验,研究用户对他人及机器人奖励刺激的行为反应,发现奖励不增加活跃度,但促进直接交流,表明用户对简单行为操纵具有抵抗力。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00824 2026-07-02 cs.PL 新提交 50%

Practical Range Refinement Types with Inference

实用的带推断的范围细化类型

Valentin Aebi, Carlo A. Furia

专题命中 机器人操作 :manipulation(abstract)

AI总结 提出Ranger系统,通过双向类型推断和轻量级流敏感分析,减少整数范围细化类型的注解负担,有效验证数组边界等属性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01163 2026-07-02 hep-ph 新提交 50%

HyperFORM -- a FORM package for parametric integration with hyperlogarithms

HyperFORM -- 用于超对数参数积分的FORM软件包

Adam Kardos, Sven-Olaf Moch, Oliver Schnetz

专题命中 机器人操作 :manipulation(abstract)

AI总结 HyperFORM将超对数参数积分引入FORM系统,移植了HyperInt的功能,利用FORM处理大量代数输入的速度和多核并行能力,通过三圈锯齿周期示例展示用法,并测量了至六圈的性能。

Comments 9 pages, 4 figures, 1 table; contribution to the proceedings of the Loops and Legs in Quantum Field Theory conference (LL2026), April 12-17, 2026, Bayreuth, Germany

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00997 2026-07-02 cond-mat.mtrl-sci 新提交 50%

Geometry-Driven Magnetoelectric Coupling in Two-Dimensional Compensated Ferrimagnets

几何驱动二维补偿亚铁磁体中的磁电耦合

Peibo Xu, Yixuan Che, Haifeng Lv, Xiaojun Wu, Jinlong Yang

专题命中 机器人操作 :manipulation(abstract)

AI总结 针对补偿磁体中磁电耦合受对称性限制的问题,提出基于双层呼吸笼目晶格的几何驱动自旋-铁电耦合机制,通过面外极化与层内结构畸变互锁实现自旋劈裂的可逆翻转,并在Nb3Cl8中通过第一性原理计算验证。

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 9 篇

2607.01044 2026-07-02 cs.RO 新提交 83%

Robots Ask the Way: Communication-Enabled Social Navigation

机器人问路:支持通信的社交导航

Valentino Sacco, Luca Scofano, Indro Spinelli, Fabio Galasso

机构 * Sapienza University of Rome(罗马大学)

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出CommNav任务,让机器人通过主动与居民通信获取信息来定位目标个体,在Habitat 3.0c环境中评估,通信模块使导航成功率提升10个百分点,且对自然语言鲁棒。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00673 2026-07-02 cs.RO 新提交 83%

Path Planning in Physically Viable World Models

物理可行世界模型中的路径规划

Su Ann Low, Cheng-Hsi Hsiao, Xingjian Li, Adam J. Thorpe, Ufuk Topcu, Krishna Kumar

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 具身导航 :world model(title,abstract);navigation(abstract);分类 cs.RO

AI总结 提出物理可行世界模型,通过物理仿真生成修改后的场景,使机器人能在部署前评估未来地形变化对路径可行性的影响。

Comments 18 pages, 7 figures, submitted to CORL

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00028 2026-07-02 cs.RO 新提交 79%

Trajectory Learning with Graph Representations for Social Robot Navigation

面向社交机器人导航的图表示轨迹学习

Berke Kartal, Burcu Kilic, Yigit Yildirim, Emre Ugur

机构 * Bogazici University(博德加齐大学) CREATE Consortium(CREATE联盟)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出一种结合图注意力网络和轨迹级学习的模仿学习框架,通过编码时空交互动态实现社交合规导航,在仿真和真实数据上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00316 2026-07-02 eess.SP 新提交 67%

Evolving Intelligent Complex Systems via Intellicise Networks: Architecture, Technologies, and Pathways

通过智能网络演化智能复杂系统:架构、技术与路径

Ping Zhang, Rui Meng, Xiaodong Xu, Song Gao, Zixuan Huang, Yaheng Wang, Yinqiu Liu, Ruichen Zhang, Yiming Liu, Kaiwen Yu, Yaping Sun, Han Meng, Haonan Tong, Huishi Song, Qianqian Yang, Shuoyao Wang, Lexi Xu, Qinghe Du, Geng Sun, Jiawen Kang, Gang Wu, Yiqing Zhou, Haixia Zhang, Zesong Fei, Aimin Hao, Ming Li

专题命中 具身导航 :embodied AI(abstract);embodied agent(abstract)

AI总结 本文提出基于智能网络的跨域智能通信网络架构,融合信息论、系统论等理论,通过语义提取、意图理解、生成式AI等技术,实现复杂系统的自配置与自优化,并给出具身智能通信案例。

Comments 23 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00065 2026-07-02 cs.RO cs.AI 新提交 62%

Optimal any-angle path planning in static and dynamic environments

静态与动态环境中的最优任意角度路径规划

Yiyuan Zou, Clark Borst

机构 * Faculty of Aerospace Engineering, Delft University of Technology(航空航天工程学院,代尔夫特理工大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 提出椭圆前向扩展和视野技术加速最优任意角度路径规划,开发Zeta*和Zeta*-SIPP算法,在静态和动态环境中保持最优性,速度提升20倍以上。

Comments 33 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01200 2026-07-02 cs.RO 新提交 57%

FastBridge: Closing the Model-Based Realization Gap in Safety Filters on 3D Gaussian Splatting for Fast Quadrotor Flight

FastBridge: 缩小基于模型的安全滤波器在3D高斯泼溅用于快速四旋翼飞行中的实现差距

Tscholl Dario, Nakka Yashwanth Kumar, Gunter Brian

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 针对快速四旋翼飞行中安全滤波器的模型实现差距,提出一种基于全四旋翼动力学的非线性、执行器感知安全滤波器,利用碰撞锥指数障碍函数和备份CBF,在保持QP可行性的同时降低轨迹加加速度47%并提速2.25倍。

Comments preprint, 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00189 2026-07-02 cs.CV 新提交 57%

VOCA: Visual Odometry with Codec Awareness

VOCA: 具有编解码感知的视觉里程计

Nouri Alexander Hilscher, Mateo de Mayo, Dominik Muhle, Christoph Otten genannt Hermes, Daniel Cremers

机构 * Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 具身导航 :world model(abstract);分类 cs.CV

AI总结 提出VOCA方法,利用视频编解码信息改进压缩流上的立体视觉里程计跟踪性能,在因果VO上达到最先进的相对轨迹误差和效率。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25965 2026-07-02 cs.RO 新提交 57%

Mixture-of-Experts RL for Fault-Tolerant Legged Locomotion

用于容错腿部运动的混合专家强化学习

Giulio Turrisi, Ozan Pali, Luca Oneto, Claudio Semini

机构 * Dynamic Legged Systems Laboratory, Istituto Italiano di Tecnologia (IIT), Genova, Italy(意大利技术研究院(IIT)动态腿足系统实验室,热那亚,意大利) Dipartimento di Informatica, Bioingegneria, Robotica e Ingegneria dei Sistemi (DIBRIS), Universita di Genova, Genova, Italy(热那亚大学计算机科学、生物工程、机器人及系统工程系(DIBRIS),热那亚,意大利)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 提出一种故障感知模块化控制架构,利用故障诊断信息激活针对不同执行器故障模式的专家策略,在多种故障场景下优于同等规模的单一策略,且适用于计算受限平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00524 2026-07-02 cs.GR 新提交 50%

Geometric Shape Optimization for Limbless Locomotion

无肢运动的几何形状优化

Utpal Khanal, Avirup Mandal

专题命中 具身导航 :robotics(abstract)

AI总结 提出一种基于傅里叶-切比雪夫多项式基的微分几何框架,通过优化多项式系数模拟蛇等细长软体运动,结合弯曲和扭转能量项确保物理合理性,实现逼真可视化。

Comments 19 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身推理 6 篇

2607.00457 2026-07-02 cs.AI 新提交 88%

Multi-scale Mixture of World Models for Embodied Agents in Evolving Environments

面向演化环境中具身智能体的多尺度世界模型混合

Jinwoo Jang, Daniel J. Rho, Sihyung Yoon, Hyunsuk Cho, Honguk Woo

专题命中 具身推理 :embodied agent(title,abstract);world model(title,abstract);分类 cs.AI

AI总结 提出MuSix框架,通过尺度感知的世界模型混合与演化,解决具身智能体在动态环境中的多尺度推理和知识适应问题,在EmbodiedBench和HAZARD上超越现有方法。

Comments Accepted at ECCV 2026. 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00148 2026-07-02 cs.RO cs.CV 新提交 86%

3D Point World Models: Point Completion Enables More Accurate Dynamics Learning

3D点云世界模型:点云补全实现更准确的动力学学习

Skand Peri, Hung Nguyen, Chanho Kim, Li Fuxin, Stefan Lee

机构 * Oregon State University(俄勒冈州立大学)

专题命中 具身推理 :world model(title,abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 提出3D点云世界模型(3DPWM),通过先补全部分点云再学习动作条件动力学,实现长时程可靠推演和精确成本评估,支持多种机器人操作任务。

Comments 21 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00310 2026-07-02 cs.CV cs.AI 新提交 84%

RetailSMV: Exocentric vs. Egocentric Adaptation of Foundation Video World Models in Retail

RetailSMV:零售场景中基础视频世界模型的外视角与内视角适应

Amirreza Rouhi, Rajat Aggarwal, Parikshit Sakurikar, Anoop M. Namboodiri, Sashi P. Reddi

机构 * DreamVu

专题命中 具身推理 :world model(title,abstract);embodied agent(abstract);分类 cs.AI、cs.CV

AI总结 研究零售场景下基础视频世界模型的外视角与内视角适应,发现仅用外视角数据训练的模型在多项指标上优于或等同于联合训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00917 2026-07-02 cs.LG cs.AI 新提交 81%

Valdi: Value Diffusion World Models

Valdi: 价值扩散世界模型

Christopher Lindenberg, Kashyap Chitta

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 提出Valdi框架,结合端到端在线训练与潜在扩散动力学模型,在CarRacing环境中使用单步扩散达到与确定性MLP基线相当的性能,揭示了预测多模态与控制性能之间的权衡。

Comments RLC 2026 WMW

详情

展开后加载摘要…

URL PDF HTML 收藏