arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-09 至 2026-03-09 共收录 74 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2603.01474 2026-03-09 cs.RO 88%

ROSER: Few-Shot Robotic Sequence Retrieval for Scalable Robot Learning

ROSER:用于可扩展机器人学习的少样本机器人序列检索

Zillur Rahman, Eddison Pham, Alejandro Daniel Noel, Cristian Meo

机构 * University of Nevada, Las Vegas(内华达大学拉斯维加斯分校) University of Toronto(多伦多大学) LatentWorlds AI

专题命中 机器人学习 :robot learning(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 ROSER通过少样本检索框架有效解决机器人序列数据稀缺问题,提升机器人学习的数据可用性。

Comments 2026 ICLR DATA-FM Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 24 篇

2506.08706 2026-03-09 cs.RO cs.SE 85%

ROS-related Robotic Systems Development with V-model-based Application of MeROS Metamodel

基于V模型的MeROS元模型在ROS相关机器人系统开发中的应用

Tomasz Winiarski, Jan Kaniuka, Daniel Giełdowski, Jakub Ostrysz, Krystian Radlak, Dmytro Kushnir

机构 * Warsaw University of Technology, Institute of Control(华沙技术大学控制学院) Warsaw University of Technology, Institute of Computer Science(华沙技术大学计算机科学学院) Industrial Research Institute for Automation(自动化与测量工业研究院) Ukrainian Catholic University, Applied Science Faculty(乌克兰天主教大学应用科学学院)

专题命中 机器人操作 :robotic(title,abstract);robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 本文提出基于MeROS元模型和V模型的方法,用于整合ROS与MBSE,提升机器人系统的设计可追溯性和验证能力。

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05574 2026-03-09 cs.RO cs.AI 84%

PRISM: Personalized Refinement of Imitation Skills for Manipulation via Human Instructions

PRISM:通过人类指令个性化模仿技能的细化

Arnau Boix-Granell, Alberto San-Miguel-Tello, Magí Dalmau-Moreno, Néstor García

机构 * Eurecat, Centre Tecnològic Catalunya, Robotics & Automation Unit(Eurecat,加泰罗尼亚技术中心,机器人与自动化单位)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI;robotics(comments)

AI总结 PRISM通过人类指令优化机器人操作中的模仿策略,提升任务执行的鲁棒性和数据效率。

Comments 10 pages, 3 figures, Accepted for publication at European Robotics Forum 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03362 2026-03-09 cs.RO 84%

Robustness-Aware Tool Selection and Manipulation Planning with Learned Energy-Informed Guidance

具有学习能量感知指导的鲁棒工具选择与操作规划

Yifei Dong, Yan Zhang, Sylvain Calinon, Florian T. Pokorny

机构 * division of Robotics, Perception and Learning, KTH Royal Institute of Technology(机器人、感知与学习系,皇家理工学院) Idiap Research Institute(Idiap研究机构) EPFL(瑞士联邦理工学院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出了一种基于学习能量感知指导的鲁棒工具选择与操作规划方法,通过分层优化流程提升工具使用在外部干扰下的鲁棒性。

Comments IEEE International Conference on Robotics and Automation (ICRA), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06280 2026-03-09 cs.RO 83%

SuperSuit: An Isomorphic Bimodal Interface for Scalable Mobile Manipulation

SuperSuit:一种用于可扩展移动操作的同构双模接口

Tongqing Chen, Hang Wu, Jiasen Wang, Xiaotao Li, Zhu Jin, Lu Fang

机构 * Tsinghua University(清华大学) TARS Robotics(TARS机器人)

专题命中 机器人操作 :manipulation(title,abstract);embodied AI(abstract);分类 cs.RO

AI总结 SuperSuit 提出了一种双模数据采集框架,通过同构运动学接口实现移动机械臂的高效长周期演示和策略训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05757 2026-03-09 cs.RO 83%

EmboAlign: Aligning Video Generation with Compositional Constraints for Zero-Shot Manipulation

EmboAlign:通过组合约束对齐视频生成以实现零样本操控

Gehao Zhang, Zhenyang Ni, Payal Mohapatra, Han Liu, Ruohan Zhang, Qi Zhu

机构 * Northwestern University(西北大学) Stanford University(斯坦福大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 EmboAlign通过视觉语言模型生成组合约束,对齐视频生成模型输出,提升零样本机器人操控的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05552 2026-03-09 cs.RO 83%

TEGA: A Tactile-Enhanced Grasping Assistant for Assistive Robotics via Sensor Fusion and Closed-Loop Haptic Feedback

TEGA: 一种通过传感器融合和闭环触觉反馈的触觉增强抓取助手用于辅助机器人

Hengxu You, Tianyu Zhou, Fang Xu, Kaleb Smith, Eric Jing Du

机构 * Department of Civil and Coastal Engineering, University of Florida(土木与海岸工程系,佛罗里达大学) Nvidia(英伟达)

专题命中 机器人操作 :robotics(title);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 TEGA通过融合EMG意图到力推断与触觉传感,提供闭环触觉反馈,提升残疾用户抓取稳定性与任务成功率。

Comments Accepted to include in ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06538 2026-03-09 cs.RO 79%

Unified Learning of Temporal Task Structure and Action Timing for Bimanual Robot Manipulation

双臂机械臂操作中时间任务结构与动作时机的统一学习

Christian Dreher, Patrick Dormanns, Andre Meixner, Tamim Asfour

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出了一种统一学习双臂机械臂时间任务结构与动作时机的方法,通过符号和亚符号时间约束生成可执行的执行计划。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06356 2026-03-09 cs.RO 79%

Safe Consensus of Cooperative Manipulation with Hierarchical Event-Triggered Control Barrier Functions

具有分层事件触发控制屏障函数的协作操作安全一致性

Simiao Zhuang, Bingkun Huang, Zewen Yang

机构 * Munich Institute of Robotics and Machine Intelligence (MIRMI), Technical University of Munich (TUM)(慕尼黑机器人与机器智能研究所(MIRMI),技术大学慕尼黑(TUM))

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出了一种基于分层事件触发控制屏障函数的分布式控制框架,实现多机械臂协作操作中的安全一致性,通过减少在线计算和提高精度,展示了在动态障碍物环境下的高效协作性能。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05355 2026-03-09 cs.RO 79%

OmniDP: Beyond-FOV Large-Workspace Humanoid Manipulation with Omnidirectional 3D Perception

OmniDP: 在超广角大工作空间中实现人形机器人的全方位3D感知

Pei Qu, Zheng Li, Yufei Jia, Ziyun Liu, Liang Zhu, Haoang Li, Jinni Zhou, Jun Ma

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Tsinghua University(清华大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 OmniDP通过360度全景点云感知和时间感知注意力池化机制,实现人形机器人在大工作空间中的稳健操作,优于传统深度相机方法。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05861 2026-03-09 cs.RO 70%

DexEMG: Towards Dexterous Teleoperation System via EMG2Pose Generalization

DexEMG: 通过EMG2Pose泛化实现灵巧遥控系统

Qianyou Zhao, Wenqiao Li, Chiyu Wang, Kaifeng Zhang

机构 * Sharpa Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 DexEMG通过EMG2Pose泛化实现灵巧遥控系统,利用sEMG信号提升机器人手的高精度操控与环境适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05804 2026-03-09 cs.RO 70%

CDF-Glove: A Cable-Driven Force Feedback Glove for Dexterous Teleoperation

CDF-Glove: 一种用于灵巧遥控操作的电缆驱动力反馈手套

Huayue Liang, Ruochong Li, Yaodong Yang, Long Zeng, Yuanpei Chen, Xueqian Wang

机构 * Center for Artificial Intelligence and Robotics, Shenzhen International Graduate School, Tsinghua University(人工智能与机器人中心,深圳国际研究生院,清华大学) PKU-Psibot Joint Lab(北京大学-PsiBot联合实验室) Department of Advanced Manufacturing, Shenzhen International Graduate School, Tsinghua University(先进制造系,深圳国际研究生院,清华大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 CDF-Glove是一种低成本的电缆驱动力反馈手套,通过实时力反馈提升灵巧遥控操作的演示质量和任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07619 2026-03-09 cs.RO 70%

CAVER: Curious Audiovisual Exploring Robot

CAVER:好奇的视听探索机器人

Luca Macesanu, Boueny Folefack, Samik Singh, Ruchira Ray, Ben Abbatematteo, Roberto Martín-Martín

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 CAVER是一种新型机器人,通过好奇心驱动的探索算法和多模态视听表示,提升材料分类和音频示范模仿的性能。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19974 2026-03-09 cs.RO 70%

Push Anything: Single- and Multi-Object Pushing From First Sight with Contact-Implicit MPC

Push Anything: 从首次视觉感知实现单对象和多对象推移的接触隐式MPC

Hien Bui, Yufeiyang Gao, Haoran Yang, Eric Cui, Siddhant Mody, Brian Acosta, Thomas Stephen Felix, Bibit Bianchini, Michael Posa

机构 * General Robotics, Automation, Sensing, and Perception (GRASP) Laboratory(通用机器人、自动化、感知与感知实验室)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 本研究提出C3+算法,通过接触隐式MPC实现从首次视觉感知到多对象推移的高效操控,实现98%的成功率。

Comments Presented at ICRA 2026; 8 pages, 8 figures. Hien Bui, Yufeiyang Gao, and Haoran Yang contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06543 2026-03-09 cs.CV 70%

Token Bottleneck: One Token to Remember Dynamics

令牌瓶颈:一个令牌来记住动态

Taekyung Kim, Dongyoon Han, Byeongho Heo, Jeongeun Park, Sangdoo Yun

机构 * NAVER AI Lab(NAVER AI实验室) Korea University(韩国大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.CV

AI总结 Token Bottleneck通过压缩场景为一个令牌并利用补丁提示来学习动态场景的序列表示,从而在视觉跟踪和机器人操作等任务中实现优越性能。

Comments NeurIPS 2025, 18 pages, 9 figures, 10 tables, project page: https://token-bottleneck.github.io, code: https://github.com/naver-ai/tobo

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05935 2026-03-09 cs.RO 61%

Swooper: Learning High-Speed Aerial Grasping With a Simple Gripper

Swooper: 一种简单抓取器的高速空中抓取学习

Ziken Huang, Xinze Niu, Bowen Chai, Renbiao Jin, Danping Zou

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(自动化与智能感知学院,上海交通大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO;robotics(journal_ref)

AI总结 Swooper通过深度强化学习实现高速空中抓取,使用轻量级神经网络策略在25次试验中达到84%的成功率和1.5m/s的抓取速度。

Journal ref IEEE Robotics and Automation Letters ( Volume: 11, Issue: 2, February 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05625 2026-03-09 cs.LG 57%

Identifying Adversary Characteristics from an Observed Attack

从观察到的攻击中识别攻击者特征

Soyon Choi, Scott Alfeld, Meiyi Ma

机构 * Vanderbilt University(范德比大学) Amherst College(阿默斯特学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 本文提出了一种领域无关的框架,用于从观察到的攻击中识别攻击者特征,以提高自动化决策系统中的安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19319 2026-03-09 cs.CV 57%

SyncMV4D: Synchronized Multi-view Joint Diffusion of Appearance and Motion for Hand-Object Interaction Synthesis

SyncMV4D: 同步多视角联合生成外观与运动的 hand-object 交互合成

Lingwei Dang, Zonghan Li, Juntong Li, Hongwen Zhang, Liang An, Yebin Liu, Qingyao Wu

专题命中 机器人操作 :robotics(abstract);分类 cs.CV

AI总结 SyncMV4D通过联合生成多视角手-物体交互视频和4D运动,提升了视觉真实性和运动合理性。

Comments The structure and logic of writing will undergo a complete revision

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03645 2026-03-09 quant-ph 50%

Resource-Efficient Emulation of Majorana Zero Mode Braiding on a Superconducting Trijunction

高效模拟超导三叉 junction 中的马约拉纳零模编织

Rahul Singh, Weixin Lu, Kaelyn J Ferris, Javad Shabani

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出了一种高效方法,利用量子处理器在三叉 junction 几何结构中模拟马约拉纳零模编织,通过减少量子门开销实现资源高效模拟。

Comments 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06144 2026-03-09 cond-mat.mtrl-sci cond-mat.str-el 50%

Electric field switching of chiral phonons

电场调控手性声子

Michael Grimes, Clifford J. Allington, Hiroki Ueda, Carl P. Romao, Kurt Kummer, Puneet Kaur, Li-Shu Wang, Yao-Wen Chang, Jan-Chi Yang, Shih-Wen Huang, Urs Staub

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过电场调控铁电体BaTiO3中的手性声子角动量,揭示了可逆的旋磁效应,为非易失性控制手性声子提供了新方法。

Comments 18 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05915 2026-03-09 cs.CR 50%

ThermoCAPTCHA: Privacy-Preserving Human Verification with Farm-Resistant Traceable Tokens

ThermoCAPTCHA:具有抗农场能力的隐私保护人类验证

Shovon Paul, Md Imran Hossen, Xiali Hei

专题命中 机器人操作 :manipulation(abstract)

AI总结 ThermoCAPTCHA通过实时热成像检测活人,无需用户解谜,提升隐私保护和验证效率

Comments 18 pages, 17 figures. Submitted manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05802 2026-03-09 cs.SI 50%

The Architects of Narrative Evolution: Actor Interventions Across the SAGES Framework in Information Campaigns

叙事演化的架构师:在信息运动中SAGES框架下各类行动者的干预

Lynnette Hui Xian Ng, Yukai Zeng, Muthiah Ponmani

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出SAGES框架,通过分析信息运动中行动者的干预,探讨叙事演变机制及反制策略。

Comments Published in Hawaii International Conference on System Sciences 2026 https://hdl.handle.net/10125/111702

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05633 2026-03-09 eess.SP cs.IT math.IT 50%

A Survey on Stacked Intelligent Metasurfaces: Fundamentals, Recent Advances, and Challenges

关于堆叠智能超材料的综述:基础、近期进展与挑战

Chandan Kumar Sheemar, Wali Ullah Khan, Sourabh Solanki, George C. Alexandropoulos, Symeon Chatzinotas

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文综述了堆叠智能超材料在无线通信中的应用,涵盖其物理原理、建模方法及未来发展方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03738 2026-03-09 cs.CL 50%

Activation-Space Personality Steering: Hybrid Layer Selection for Stable Trait Control in LLMs

激活空间人格引导:用于LLMs中稳定特质控制的混合层选择

Pranav Bhandari, Nicolas Fay, Sanjeevan Selvaganapathy, Amitava Datta, Usman Naseem, Mehwish Nasim

机构 * Network Analysis and Social Influence Modelling (NASIM) Lab(网络分析与社会影响建模实验室) School of Physics Maths and Computing, The University of Western Australia(西澳大学物理数学与计算学院) School of Psychological Science, The University of Western Australia(西澳大学心理学科学学院) School of Computing, Macquarie University(麦考瑞大学计算机学院)

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出通过混合层选择方法,在LLMs中实现稳定的人格控制,利用Big Five人格特质构建低秩子空间,以提升模型输出的可控性与实用性。

Comments Accepted to EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15704 2026-03-09 physics.chem-ph 50%

Metatensor and metatomic: foundational libraries for interoperable atomistic machine learning

元张量和元原子:用于互操作性原子级机器学习的基础库

Filippo Bigi, Joseph W. Abbott, Philip Loche, Arslan Mazitov, Davide Tisi, Marcel F. Langer, Alexander Goscinski, Paolo Pegolo, Sanggyu Chong, Rohit Goswami, Pol Febrer, Sofiia Chorna, Matthias Kellner, Michele Ceriotti, Guillaume Fraux

专题命中 机器人操作 :manipulation(abstract)

AI总结 元张量和元原子库为原子级机器学习提供互操作性基础,促进传统模拟软件与现代ML框架的整合。

Journal ref J. Chem. Phys. 164, 064113 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 17 篇

2603.06073 2026-03-09 cs.RO cs.AI 81%

Lifelong Embodied Navigation Learning

持续性具身导航学习

Xudong Wang, Jiahua Dong, Baichen Liu, Qi Lyu, Lianqing Liu, Zhi Han

机构 * State Key Laboratory of Robotics and Intelligent Systems(机器人与智能系统国家重点实验室) Shenyang Institute of Automation(沈阳自动化研究所) Chinese Academy of Sciences(中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 Uni-Walker通过分解导航知识为共享和特定组件,解决持续性具身导航学习中的灾难性遗忘问题,提升导航代理的持续学习能力。

Comments 24 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06266 2026-03-09 cs.RO 80%

Towards Robotic Lake Maintenance: Integrating SONAR and Satellite Data to Assist Human Operators

迈向机器人湖泊维护:整合SONAR和卫星数据以协助人类操作员

Ahmed H. Elsayed, Christoph Manss, Tarek A. El-Mihoub, Andrej Lejman, Frederic Stahl

机构 * Marine Perception Department(海洋感知部门) German Research Center for Artificial Intelligence (DFKI), Oldenburg, Germany(德国人工智能研究中心(DFKI),奥尔德堡,德国)

专题命中 具身导航 :robotic(title);navigation(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出利用卫星和SONAR数据辅助人类操作员进行人工湖泊杂草收获的两阶段方法,通过卫星检测和声纳测绘提高维护效率。

Comments Accepted to and presented at the 2026 IEEE International Conference on Mechatronics and Robotics Engineering (ICMRE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06058 2026-03-09 cs.RO 80%

RODEO: RObotic DEcentralized Organization

Milan Groshev, Eduardo Castelló Ferrer

机构 * CyPhy Life, Robotics & AI Lab, School of Science & Technology, IE University(CyPhy生命、机器人与人工智能实验室,科学与技术学院,IE大学)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO;robotics(comments)

Comments 8 pages, 6 figures, Accepted at IEEE International Conference on Robotics & Automation (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05805 2026-03-09 cs.RO 79%

InsSo3D: Inertial Navigation System and 3D Sonar SLAM for turbid environment inspection

InsSo3D:惯性导航系统与3D声呐SLAM用于浑浊环境检测

Simon Archieri, Ahmet Cinar, Shu Pan, Jonatan Scharff Willners, Michele Grimaldi, Ignacio Carlucho, Yvan Petillot

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 InsSo3D结合3D声呐和惯性导航系统,实现高效准确的水下SLAM,适用于浑浊环境中的结构检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06190 2026-03-09 cs.RO 79%

DreamToNav: Generalizable Navigation for Robots via Generative Video Planning

DreamToNav: 通过生成式视频规划实现通用机器人导航

Valerii Serpiva, Jeffrin Sam, Chidera Simon, Hajira Amjad, Iana Zhura, Artem Lykov, Dzmitry Tsetserukou

机构 * Intelligent Space Robotics Laboratory, Skolkovo Institute of Science and Technology(智能空间机器人实验室,斯克尔科夫科学与技术研究所)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 DreamToNav通过生成式视频规划实现通用机器人导航,利用自然语言提示生成精确运动路径,实现目标导向的自主导航。

Comments Submitted to conference

详情

展开后加载摘要…

URL PDF HTML 收藏