arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

世界模型

面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。

共收录 504 信号源:cs.AI, cs.LG, cs.CV, cs.RO, cs.MA

1. 具身与机器人 504 篇

2509.12151 2026-03-03 cs.RO cs.LG 50%

Learning Contact Dynamics through Touching: Action-conditional Graph Neural Networks for Robotic Peg Insertion

通过接触学习动态:用于机器人圆柱体插入的基于动作的图神经网络

Zongyao Yi, Joachim Hertzberg, Martin Atzmueller

机构 * German Research Center for Artificial Intelligence(德国人工智能研究中心) Osnabrück University(奥斯纳布吕克大学)

专题命中 具身与机器人 :分类 cs.LG、cs.RO;dynamics model(abstract);predictive model(abstract)

AI总结 本文提出了一种基于动作的图神经网络模型,用于提升机器人圆柱体插入任务中的运动和力矩预测精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19651 2026-02-24 cs.RO cs.AI cs.LG 50%

Denoising Particle Filters: Learning State Estimation with Single-Step Objectives

去噪粒子滤波:基于单步目标的学习状态估计

Lennart Röstel, Berthold Bäuml

机构 * Learning AI for Dextrous Robots Lab, Technical University of Munich(灵活机器人学习人工智能实验室,慕尼黑技术大学)

专题命中 具身与机器人 :分类 cs.AI、cs.LG、cs.RO;dynamics model(abstract)

AI总结 本文提出了一种基于单步目标的去噪粒子滤波方法,通过隐式学习测量模型和动力学模型,实现高效的机器人状态估计,具有可组合性和良好的性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20675 2025-12-25 cs.LG cs.AI 50%

Revisiting the Learning Objectives of Vision-Language Reward Models

重新审视视觉-语言奖励模型的学习目标

Simon Roy, Samuel Barbeau, Giovanni Beltrame, Christian Desrosiers, Nicolas Thome

机构 * Polytechnique Montréal(蒙特利尔理工学院) École de Technologie Supérieure(高级技术学院) Sorbonne Université(索邦大学)

专题命中 具身与机器人 :world model(comments);分类 cs.AI、cs.LG;world model(comments)

AI总结 本文通过统一框架评估了基于VLM的奖励模型,发现简单三元组损失在性能上优于现有方法,表明改进可能源于数据和架构差异。

Comments Published as an extended abstract at World Modeling Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08884 2025-12-15 cs.RO 50%

Model-Based Lookahead Reinforcement Learning for in-hand manipulation

基于模型的 lookahead 强化学习用于手部操作

Alexandre Lopes, Catarina Barata, Plinio Moreno

专题命中 具身与机器人 :model-based reinforcement learning(abstract);分类 cs.RO

AI总结 本文提出了一种混合强化学习框架,用于提高手部操作任务的性能,通过结合模型无关和模型相关的强化学习方法,以提高任务表现,但增加了计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03256 2025-12-04 cs.RO 50%

KALIKO: Kalman-Implicit Koopman Operator Learning For Prediction of Nonlinear Dynamical Systems

KALIKO:基于卡尔曼隐式Koopman算子的学习用于非线性动力系统预测

Albert H. Li, Ivan Dario Jimenez Rodriguez, Joel W. Burdick, Yisong Yue, Aaron D. Ames

机构 * Caltech(加州理工学院)

专题命中 具身与机器人 :latent dynamics(abstract);分类 cs.RO

AI总结 KALIKO通过卡尔曼滤波隐式学习高维非线性动态系统,实现高精度预测与稳定控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02400 2025-12-03 cs.CV 50%

Nav-$R^2$ Dual-Relation Reasoning for Generalizable Open-Vocabulary Object-Goal Navigation

Nav-$R^2$双关系推理用于通用开放词汇目标导航

Wentao Xiang, Haokang Zhang, Tianhang Yang, Zedong Chu, Ruihang Chu, Shichao Xie, Yujian Yuan, Jian Sun, Zhining Gu, Junjie Wang, Xiaolong Wu, Mu Xu, Yujiu Yang

机构 * Tsinghua University(清华大学) Amap, Alibaba Group(阿里巴巴集团的阿里的地图)

专题命中 具身与机器人 :environment model(abstract);分类 cs.CV

AI总结 Nav-R2通过双关系推理和相似性感知记忆,在开放词汇环境下实现高效目标导航,提升未见对象定位性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25822 2025-11-13 cs.RO 50%

Act to See, See to Act: Diffusion-Driven Perception-Action Interplay for Adaptive Policies

Jing Wang, Weiting Peng, Jing Tang, Zeyu Gong, Xihua Wang, Bo Tao, Li Cheng

机构 * University of Alberta(阿尔伯塔大学) Huazhong University of Science and Technology(华中科技大学)

专题命中 具身与机器人 :latent dynamics(abstract);分类 cs.RO

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01484 2025-10-29 cs.RO 50%

Robot Cell Modeling via Exploratory Robot Motions: A Novel and Accessible Data-Driven Approach

Gaetano Meli, Niels Dehio

机构 * KUKA Deutschland GmbH(德国库卡股份有限公司)

专题命中 具身与机器人 :environment model(abstract);分类 cs.RO

Comments 8 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22699 2025-10-28 cs.RO 50%

RL-AVIST: Reinforcement Learning for Autonomous Visual Inspection of Space Targets

Matteo El-Hariry, Andrej Orsula, Matthieu Geist, Miguel Olivares-Mendez

机构 * Earth Species Project(地球物种计划)

专题命中 具身与机器人 :model-based RL(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08568 2025-10-10 cs.RO cs.AI cs.CV 50%

NovaFlow: Zero-Shot Manipulation via Actionable Flow from Generated Videos

Hongyu Li, Lingfeng Sun, Yafei Hu, Duy Ta, Jennifer Barry, George Konidaris, Jiahui Fu

机构 * Robotics and AI Institute(机器人与人工智能研究所) Brown University(布朗大学)

专题命中 具身与机器人 :分类 cs.AI、cs.CV、cs.RO;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04171 2025-10-07 cs.RO 50%

VBM-NET: Visual Base Pose Learning for Mobile Manipulation using Equivariant TransporterNet and GNNs

Lakshadeep Naik, Adam Fischer, Daniel Duberg, Danica Kragic

机构 * KTH Royal Institute of Technology(皇家理工学院)

专题命中 具身与机器人 :environment model(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19041 2025-09-24 cs.HC 50%

Position: Human-Robot Interaction in Embodied Intelligence Demands a Shift From Static Privacy Controls to Dynamic Learning

Shuning Zhang, Hong Jia, Simin Li, Ting Dang, Yongquan `Owen' Hu, Xin Yi, Hewu Li

专题命中 具身与机器人 :world model(comments);world models(comments);world model(comments);world models(comments)

Comments To be published in NeurIPS 2025 Workshop on Bridging Language, Agent, and World Models for Reasoning and Planning

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06714 2025-09-09 cs.LG 50%

RT-HCP: Dealing with Inference Delays and Sample Efficiency to Learn Directly on Robotic Platforms

Zakariae El Asri, Ibrahim Laiche, Clément Rambour, Olivier Sigaud, Nicolas Thome

机构 * Sorbonne Université, CNRS, ISIR(索邦大学、法国国家科学研究中心、ISIR研究所) Institut Universitaire de France (IUF)(法国大学机构(IUF))

专题命中 具身与机器人 :model-based reinforcement learning(abstract);分类 cs.LG

Comments IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17070 2025-08-26 cs.RO 50%

LaGarNet: Goal-Conditioned Recurrent State-Space Models for Pick-and-Place Garment Flattening

Halid Abdulrahim Kadi, Kasim Terzić

机构 * School of Computer Science, University of St Andrews(计算机科学学院,圣安德鲁大学)

专题命中 具身与机器人 :latent dynamics(abstract);分类 cs.RO

Comments 20 pages, 11 figures and 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15755 2025-08-22 cs.RO cs.AI cs.GR cs.LG 50%

Neural Robot Dynamics

Jie Xu, Eric Heiden, Iretiayo Akinola, Dieter Fox, Miles Macklin, Yashraj Narang

机构 * NVIDIA(NVIDIA公司) University of Washington(华盛顿大学)

专题命中 具身与机器人 :分类 cs.AI、cs.LG、cs.RO;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12768 2025-07-18 cs.CV cs.LG cs.RO 50%

AnyPos: Automated Task-Agnostic Actions for Bimanual Manipulation

Hengkai Tan, Yao Feng, Xinyi Mao, Shuhe Huang, Guodong Liu, Zhongkai Hao, Hang Su, Jun Zhu

机构 * Dept. of Comp. Sci. and Tech.(计算机科学与技术系) Institute for AI(人工智能研究院) BNRist Center(BNRist中心) THBI Lab(THBI实验室) Tsinghua-Bosch Joint ML Center(清华大学-博世联合机器学习中心) Tsinghua University(清华大学)

专题命中 具身与机器人 :分类 cs.LG、cs.CV、cs.RO;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18562 2025-06-18 cs.RO cs.CV cs.LG 50%

DexHandDiff: Interaction-aware Diffusion Planning for Adaptive Dexterous Manipulation

Zhixuan Liang, Yao Mu, Yixiao Wang, Tianxing Chen, Wenqi Shao, Wei Zhan, Masayoshi Tomizuka, Ping Luo, Mingyu Ding

专题命中 具身与机器人 :分类 cs.LG、cs.CV、cs.RO;dynamics model(abstract)

Comments Accepted by CVPR 2025. Camera ready version. Previous DexDiffuser. Project page: https://dexdiffuser.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12450 2025-05-20 cs.RO 50%

A Robot Simulation Environment for Virtual Reality Enhanced Underwater Manipulation and Seabed Intervention Tasks

Sumey El-Muftu, Berke Gur

机构 * Graduate School, Bahçeşehir University(巴切希尔大学研究生学院)

专题命中 具身与机器人 :environment model(abstract);分类 cs.RO

Comments 7 pages with 8 figures; presented in the AQ2UASIM: Advancing Quantitative and Qualitative SIMulators for Marine Applications workshop held as a part of the IEEE International Conference on Robotics and Automation (ICRA) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08604 2025-04-14 cs.RO cs.AI cs.LG cs.SY eess.SY 50%

Neural Fidelity Calibration for Informative Sim-to-Real Adaptation

Youwei Yu, Lantao Liu

专题命中 具身与机器人 :分类 cs.AI、cs.LG、cs.RO;simulation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16346 2025-03-24 cs.RO cs.CV cs.LG cs.SY eess.SY 50%

SOUS VIDE: Cooking Visual Drone Navigation Policies in a Gaussian Splatting Vacuum

JunEn Low, Maximilian Adang, Javier Yu, Keiko Nagami, Mac Schwager

专题命中 具身与机器人 :分类 cs.LG、cs.CV、cs.RO;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01529 2025-02-28 cs.RO cs.SY eess.SY 50%

Deep Incremental Model Informed Reinforcement Learning for Continuous Robotic Control

Cong Li

专题命中 具身与机器人 :model-based reinforcement learning(abstract);分类 cs.RO

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15162 2025-02-24 cs.RO 50%

Realm: Real-Time Line-of-Sight Maintenance in Multi-Robot Navigation with Unknown Obstacles

Ruofei Bai, Shenghai Yuan, Kun Li, Hongliang Guo, Wei-Yun Yau, Lihua Xie

专题命中 具身与机器人 :environment model(abstract);分类 cs.RO

Comments 8 pages, 9 figures, accepted by IEEE ICRA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00543 2025-02-04 cs.RO cs.CV cs.LG 50%

VertiFormer: A Data-Efficient Multi-Task Transformer for Off-Road Robot Mobility

Mohammad Nazeri, Anuj Pokhrel, Alexandyr Card, Aniket Datar, Garrett Warnell, Xuesu Xiao

专题命中 具身与机器人 :分类 cs.LG、cs.CV、cs.RO;dynamics model(abstract)

Comments 9 figures, url: https://github.com/mhnazeri/VertiFormer

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13729 2024-12-25 cs.RO cs.HC cs.LG 50%

THÖR-MAGNI Act: Actions for Human Motion Modeling in Robot-Shared Industrial Spaces

Tiago Rodrigues de Almeida, Tim Schreiter, Andrey Rudenko, Luigi Palmieiri, Johannes A. Stork, Achim J. Lilienthal

专题命中 具身与机器人 :分类 cs.LG、cs.RO;predictive model(abstract);predictive models(abstract)

Comments This paper has been accepted to the the 20th edition of the IEEE/ACM International Conference on Human-Robot Interaction (HRI'25), which will be held in Melbourne, Australia on March 4-6, 2025. Code: https://github.com/tmralmeida/thor-magni-actions

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11360 2024-12-17 cs.RO cs.AI cs.CV 50%

Visual IRL for Human-Like Robotic Manipulation

Ehsan Asali, Prashant Doshi

专题命中 具身与机器人 :分类 cs.AI、cs.CV、cs.RO;dynamics model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08222 2024-10-01 cs.GT cs.RO 50%

Multi-Robot Coordination Induced in an Adversarial Graph-Traversal Game

James Berneburg, Xuan Wang, Xuesu Xiao, Daigo Shishika

专题命中 具身与机器人 :environment model(abstract);分类 cs.RO

Comments 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14758 2024-07-23 cs.CV 50%

DISCO: Embodied Navigation and Interaction via Differentiable Scene Semantics and Dual-level Control

Xinyu Xu, Shengcheng Luo, Yanchao Yang, Yong-Lu Li, Cewu Lu

专题命中 具身与机器人 :environment model(abstract);分类 cs.CV

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18866 2024-06-05 cs.LG 50%

Dr. Strategy: Model-Based Generalist Agents with Strategic Dreaming

Hany Hamed, Subin Kim, Dongyeong Kim, Jaesik Yoon, Sungjin Ahn

专题命中 具身与机器人 :model-based reinforcement learning(abstract);分类 cs.LG

Comments First two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08602 2024-04-30 cs.RO cs.AI cs.LG 50%

Safe Deep Policy Adaptation

Wenli Xiao, Tairan He, John Dolan, Guanya Shi

专题命中 具身与机器人 :分类 cs.AI、cs.LG、cs.RO;dynamics model(abstract)

Comments ICRA 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08006 2024-04-15 cs.RO cs.AI cs.LG math.OC 50%

Learning Efficient and Fair Policies for Uncertainty-Aware Collaborative Human-Robot Order Picking

Igor G. Smit, Zaharah Bukhsh, Mykola Pechenizkiy, Kostas Alogariastos, Kasper Hendriks, Yingqian Zhang

专题命中 具身与机器人 :分类 cs.AI、cs.LG、cs.RO;simulation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏