arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-04 至 2026-03-04 共收录 12 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 12 篇

2510.05684 2026-03-04 cs.AI cs.CV cs.RO 88%

D2E: Scaling Vision-Action Pretraining on Desktop Data for Transfer to Embodied AI

D2E:在桌面数据上扩展视觉-动作预训练以迁移到具身AI

Suhwan Choi, Jaeyoon Jung, Haebin Seong, Minchan Kim, Minyeong Kim, Yongjun Cho, Yoonshik Kim, Yubeen Park, Youngjae Yu, Yunsung Lee

机构 * Stanford University(斯坦福大学) Seoul National University(首尔国立大学)

专题命中 机器人数据与评测 :embodied AI(title,abstract);robotics(abstract);manipulation(abstract);navigation(abstract)

AI总结 D2E通过桌面数据预训练,实现了具身AI任务的有效迁移,其框架包含三个组件,展示了在物理操作和导航任务中的高性能表现。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02623 2026-03-04 cs.RO cs.LG 87%

Uni-Skill: Building Self-Evolving Skill Repository for Generalizable Robotic Manipulation

Uni-Skill:构建通用机器人操作的自演化技能库

Senwei Xie, Yuntian Zhang, Ruiping Wang, Xilin Chen

机构 * Key Laboratory of AI Safety of CAS(中国科学院人工智能安全重点实验室) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 机器人数据与评测 :robotic(title,abstract);manipulation(title);分类 cs.RO、cs.LG

AI总结 Uni-Skill通过自演化技能库提升机器人操作的通用性与适应性,实现高效技能检索与少样本推理。

Comments Accepted to ICRA2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17520 2026-03-04 cs.RO cs.CV 81%

InstructVLA: Vision-Language-Action Instruction Tuning from Understanding to Manipulation

InstructVLA: 从理解到操作的视觉-语言-动作指令微调

Shuai Yang, Hao Li, Bin Wang, Yilun Chen, Yang Tian, Tai Wang, Hanqing Wang, Feng Zhao, Yiyi Liao, Jiangmiao Pang

机构 * University of Science and Technology of China(中国科学技术大学) Zhejiang University(浙江大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.RO、cs.CV

AI总结 InstructVLA通过视觉-语言-动作指令微调,实现了在多模态推理和动作生成之间的平衡,提升了机器人在复杂任务中的操控性能和泛化能力。

Comments 48 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02487 2026-03-04 cs.RO 79%

A Robust Simulation Framework for Verification and Validation of Autonomous Maritime Navigation in Adverse Weather and Constrained Environments

一种用于自主水路航行在恶劣天气和受限环境下的验证与验证的稳健仿真框架

Mayur S. Patil, Nataraj Sudharsan, Anthony S. Saaiby, JiaChang Xing, Keliang Pan, Veneela Ammula, Jude Tomdio, Jin Wang, Michael Kei, Heonyong Kang, Sivakumar Rathinam, Prabhakar R. Pagilla

机构 * Department of Mechanical Engineering, Texas A&M University, College Station, USA(机械工程系,德克萨斯A&M大学,学院站,美国) Department of Ocean Engineering, Texas A&M University, College Station, USA(海洋工程系,德克萨斯A&M大学,学院站,美国) American Bureau of Shipping, Spring, TX, USA(美国船舶局,斯普林,德克萨斯州,美国)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出了一种稳健的仿真框架,用于验证和验证自主水路航行系统在恶劣天气和受限环境下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02688 2026-03-04 cs.AI cs.RO 79%

Retrieval-Augmented Robots via Retrieve-Reason-Act

通过检索-推理-行动实现增强型机器人

Izat Temiraliev, Diji Yang, Yi Zhang

机构 * University of California, Santa Cruz(加州大学圣克ruz分校)

专题命中 机器人数据与评测 :robotics(abstract);embodied agent(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出检索增强型机器人学(RAR)范式,通过检索-推理-行动循环,使机器人能从外部文档获取未见程序知识,提升复杂任务执行能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03278 2026-03-04 cs.RO cs.AI cs.CV 67%

Tether: Autonomous Functional Play with Correspondence-Driven Trajectory Warping

Tether: 基于对应驱动轨迹扭曲的自主功能性玩耍

William Liang, Sam Wang, Hung-Ju Wang, Osbert Bastani, Yecheng Jason Ma, Dinesh Jayaraman

机构 * University of Pennsylvania(宾夕法尼亚大学) University of California, Berkeley(加州大学伯克利分校) Dyna Robotics(Dyna机器人技术)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 Tether通过基于对应驱动的轨迹扭曲,实现从少量演示开始的自主多任务玩耍,生成高质量数据集并提升模仿策略性能。

Comments International Conference on Learning Representations (ICLR), 2026. Project website and code: https://tether-research.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11663 2026-03-04 cs.RO cs.AI cs.CV 67%

ConEQsA: Concurrent and Asynchronous Embodied Questions Scheduling and Answering

ConEQsA:并发与异步具身问题调度与回答

Haisheng Wang, Dong Liu, Weiming Zhi

机构 * Software Engineering Institute, East China Normal University(东华大学软件工程学院) Department of Computer Science, Yale University(耶鲁大学计算机科学系) School of Computer Science, The University of Sydney(悉尼大学计算机科学学院) College of Connected Computing, Vanderbilt University(范德比大学连接计算学院)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 ConEQsA通过并发与异步机制提升具身问题回答的效率与响应能力

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2101.07679 2026-03-04 cs.RO cs.HC 57%

The Six Hug Commandments: Design and Evaluation of a Human-Sized Hugging Robot with Visual and Haptic Perception

六条拥抱准则:一种具有视觉和触觉感知的人形拥抱机器人的设计与评估

Alexis E. Block, Sammy Christen, Roger Gassert, Otmar Hilliges, Katherine J. Kuchenbecker

机构 * Institute for Clarity in Documentation(文档清晰研究所) Inria Paris-Rocquencourt(巴黎-罗quentourt研究所) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒实验室)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出六条准则设计并评估了一种具有视觉和触觉感知的人形拥抱机器人,通过实验验证了其在提升用户感知和拥抱体验方面的有效性。

Comments 9 pages, 6 Figures, 2 Tables, ACM/IEEE Human-Robot Interaction (HRI) Conference 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02669 2026-03-04 cs.RO 57%

IMR-LLM: Industrial Multi-Robot Task Planning and Program Generation using Large Language Models

IMR-LLM:基于大语言模型的工业多机器人任务规划与程序生成

Xiangyu Su, Juzhan Xu, Oliver van Kaick, Kai Xu, Ruizhen Hu

机构 * Shenzhen University(深圳大学) SpeedBot Robotics Co., Ltd.(SpeedBot机器人科技有限公司) Carleton University(卡尔顿大学) Institute of AI for Industries, Chinese Academy of Sciences(中国科学院工业人工智能研究所)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO

AI总结 IMR-LLM通过大语言模型实现工业多机器人任务规划与程序生成,结合析取图和过程树,提出高效任务计划和可执行程序生成方法,并构建了多复杂度层次的IMR-Bench基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02640 2026-03-04 cs.CY cs.AI cs.CL cs.MA cs.SI 57%

Credibility Governance: A Social Mechanism for Collective Self-Correction under Weak Truth Signals

可信治理:在弱真相信号下的一种社会机制,用于集体自我校正

Wanying He, Yanxi Lin, Ziheng Zhou, Xue Feng, Min Peng, Qianqian Xie, Zilong Zheng, Yipeng Kang

机构 * School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院) Tsinghua University(清华大学) University of California, Los Angeles(加州大学洛杉矶分校) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 可信治理通过动态可信度评分和可信度加权背书,提升集体自我校正能力,减少虚假信息影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22499 2026-03-04 cs.CV 57%

SABER: Spatially Consistent 3D Universal Adversarial Objects for BEV Detectors

SABER: 用于鸟瞰检测器的时空一致的3D通用对抗对象

Aixuan Li, Mochu Xiang, Bosen Hou, Zhexiong Wan, Jing Zhang, Yuchao Dai

机构 * School of Electronics and Information, Northwestern Polytechnical University & Shaanxi Key Laboratory of Information Acquisition and Processing, Xi’an, China(电子工程学院,西北工业大学 & 陕西省信息采集与处理重点实验室,西安,中国) School of Computing, Australian National University(计算学院,澳大利亚国立大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 SABER提出了一种生成通用、非侵入式且3D一致的对抗对象的方法,以揭示BEV 3D目标检测器的漏洞,并提供评估自动驾驶系统鲁棒性的实用流程。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13180 2026-03-04 cs.AI 57%

ViPlan: A Benchmark for Visual Planning with Symbolic Predicates and Vision-Language Models

ViPlan:一个用于视觉规划的基准,结合符号谓词和视觉-语言模型

Matteo Merler, Nicola Dainese, Minttu Alakuijala, Giovanni Bonetta, Pietro Ferrazzi, Yu Tian, Bernardo Magnini, Pekka Marttinen

机构 * Fondazione Bruno Kessler(布鲁诺·科塞拉基金会) Department of Computer Science, Aalto University(艾尔沃斯大学计算机科学系) Department of Mathematics, Università degli Studi di Padova(帕多瓦大学数学系)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI

AI总结 ViPlan是一个用于视觉规划的基准,比较基于VLMs的符号方法与直接VLM规划方法,发现不同方法在不同任务中的表现差异。

Comments 8 pages, 5 figures and 1 table in the main text; 50 pages, 16 figures and 19 tables including supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏