arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-03-10 至 2026-03-10 共收录 35 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 35 篇

2603.08546 2026-03-10 cs.RO cs.CV cs.LG 88%

Interactive World Simulator for Robot Policy Training and Evaluation

交互式世界模拟器用于机器人策略训练与评估

Yixuan Wang, Rhythm Syed, Fangyu Wu, Mengchao Zhang, Aykut Onol, Jose Barreiros, Hooshang Nayyeri, Tony Dear, Huan Zhang, Yunzhu Li

专题命中 机器人数据与评测 :robot policy(title,abstract);robotics(abstract);world model(abstract);robotic(abstract)

AI总结 交互式世界模拟器通过构建物理一致的世界模型,实现了高效的机器人策略训练与评估,支持长时间稳定交互并展现与现实世界性能的强相关性。

Comments Project Page: https://yixuanwang.me/interactive_world_sim

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06749 2026-03-10 cs.RO cs.AI 84%

Robotic Foundation Models for Industrial Control: A Comprehensive Survey and Readiness Assessment Framework

工业控制中的机器人基础模型:全面调研与可行性评估框架

David Kube, Simon Hadwiger, Tobias Meisen

专题命中 机器人数据与评测 :robotic(title,abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 本文调研了工业控制中机器人基础模型的应用现状,通过系统评估框架分析了其工业适用性,指出工业成熟度有限,需加强安全、实时性、感知与集成等关键因素的系统性考虑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06831 2026-03-10 cs.RO math.OC 83%

Learning-Based Robust Control: Unifying Exploration and Distributional Robustness for Reliable Robotics via Free Energy

基于学习的鲁棒控制:通过自由能统一探索与分布鲁棒性以实现可靠的机器人控制

Hozefa Jesawada, Giovanni Russo, Abdalla Swikir, Fares Abu-Dakka

机构 * Mechanical Engineering Program, New York University Abu Dhabi(纽约大学阿布扎赫尔分校机械工程项目) Department of Information and Electrical Engineering & Applied Mathematics, University of Salerno(萨勒诺大学信息与电气工程及应用数学系) Mohammed bin Zayed University for Artificial Intelligence, Abu Dhabi, UAE(穆罕默德·本·扎耶德人工智能大学)

专题命中 机器人数据与评测 :robotics(title);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于自由能原理的鲁棒控制方法,通过联合学习环境动态和奖励,提升机器人在真实环境中的鲁棒性和可重复操作性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01528 2026-03-10 cs.CV cs.AI cs.RO 82%

DrivingGen: A Comprehensive Benchmark for Generative Video World Models in Autonomous Driving

DrivingGen:自主驾驶中生成视频世界模型的综合性基准

Yang Zhou, Hao Shao, Letian Wang, Zhuofan Zong, Hongsheng Li, Steven L. Waslander

机构 * University of Toronto(多伦多大学) CUHK MMLab(香港中文大学MMLab)

专题命中 机器人数据与评测 :world model(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 DrivingGen提出首个综合性基准,用于评估生成驾驶世界模型的视觉真实性、轨迹合理性、时间一致性和可控性,揭示通用与专用模型间的权衡。

Comments ICLR 2026 Poster; Project Website: https://drivinggen-bench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06919 2026-03-10 cs.RO 80%

SurgSync: Time-Synchronized Multi-Modal Data Collection Framework and Dataset for Surgical Robotics

SurgSync: 用于手术机器人的时间同步多模态数据采集框架和数据集

Haoying Zhou, Chang Liu, Yimeng Wu, Junlin Wu, Zijian Wu, Yu Chung Lee, Sara Martuscelli, Spetimiu E. Salcudean, Gregory S. Fischer, Peter Kazanzides

机构 * Department of Robotics Engineering, Worcester Polytechnic Institute(机器人工程系,沃斯特理工学院) Laboratory for Computational Sensing and Robotics(计算感知与机器人实验室) Department of Computer Science, Johns Hopkins University(计算机科学系,约翰霍普金斯大学) Robotics and Control Laboratory, the University of British Columbia(机器人与控制实验室,不列颠哥伦比亚大学) Department of Electronics, Information and Bioengineering, Politecnico di Milano(电子、信息与生物工程系,米兰理工学院)

专题命中 机器人数据与评测 :robotics(title,comments);robotic(abstract);分类 cs.RO

AI总结 SurgSync提出了一种时间同步的多模态数据采集框架和数据集,用于手术机器人中的高阶控制与训练,通过多传感器和后处理工具提升数据质量与实用性。

Comments Accepted By International Conference on Robotics and Automation (ICRA), IEEE, 2026. More details can be found at https://surgsync.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08260 2026-03-10 cs.RO 79%

Seed2Scale: A Self-Evolving Data Engine for Embodied AI via Small to Large Model Synergy and Multimodal Evaluation

Seed2Scale: 一种通过小到大模型协同和多模态评估的自我进化数据引擎用于具身AI

Cong Tai, Zhaoyu Zheng, Haixu Long, Hansheng Wu, Zhengbin Long, Haodong Xiang, Rong Shi, Zhuo Cui, Shizhuang Zhang, Gang Qiu, He Wang, Ruifeng Li, Biao Liu, Zhenzhe Sun, Tao Shen

机构 * ZTE Corporation(中兴通讯公司)

专题命中 机器人数据与评测 :embodied AI(title,abstract);分类 cs.RO

AI总结 Seed2Scale通过小到大模型协同和多模态评估,实现具身AI的自我进化数据引擎,显著提升性能并提供可扩展的开发路径

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07060 2026-03-10 cs.RO cs.HC cs.SY eess.SY 79%

GuideTWSI: A Diverse Tactile Walking Surface Indicator Dataset from Synthetic and Real-World Images for Blind and Low-Vision Navigation

GuideTWSI: 一种从合成和现实图像中获取的多样化触觉行走表面指示器数据集,用于盲人和低视力导航

Hochul Hwang, Soowan Yang, Anh N. H. Nguyen, Parth Goel, Krisha Adhikari, Sunghoon I. Lee, Joydeep Biswas, Nicholas A. Giudice, Donghyun Kim

机构 * University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校) Daegu Gyeongbuk Institute of Science and Technology(大邱庆bu科学技术院) The University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Maine(缅因大学)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出了一种多样化的触觉行走表面指示器数据集,通过合成和现实图像获取,以提高盲人和低视力导航中对不同类型警示标志的识别能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06914 2026-03-10 cs.RO 79%

SysNav: Multi-Level Systematic Cooperation Enables Real-World, Cross-Embodiment Object Navigation

SysNav:多级系统性合作实现现实世界跨载体物体导航

Haokun Zhu, Zongtai Li, Zihan Liu, Kevin Guo, Zhengzhi Lin, Yuxin Cai, Guofei Chen, Chen Lv, Wenshan Wang, Jean Oh, Ji Zhang

机构 * Carnegie Mellon University(卡内基梅隆大学) New York University(纽约大学) Nanyang Technological University(南洋理工大学)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 SysNav通过多级系统性合作实现现实世界跨载体物体导航,提升复杂环境下的导航效率与成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02419 2026-03-10 cs.CV 79%

DINOv3 Visual Representations for Blueberry Perception Toward Robotic Harvesting

DINOv3视觉表示在蓝莓感知中的应用:面向机器人采摘

Rui-Feng Wang, Daniel Petti, Yue Chen, Changying Li

机构 * Bio-Sensing, Automation, and Intelligence Laboratory, Department of Agricultural and Biological Engineering, Institute of Food and Agricultural Sciences, University of Florida(生物感知、自动化与智能实验室,农业与生物工程系,食品与农业科学研究院,佛罗里达大学) Department of Biomedical Engineering, Georgia Institute of Technology(生物医学工程系,佐治亚理工学院)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.CV

AI总结 DINOv3作为语义主干网络,在蓝莓机器人采摘中用于果实和损伤分割及检测,但检测受限于目标尺度变化和空间聚合建模的挑战。

Comments 16 pages, 9 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13816 2026-03-10 cs.RO 79%

Agile in the Face of Delay: Asynchronous End-to-End Learning for Real-World Aerial Navigation

在延迟面前敏捷:面向现实世界空中导航的异步端到端学习

Yude Li, Zhexuan Zhou, Huizhe Li, Youmin Gong, Jie Mei

机构 * School of Intelligence and Engineering(智能与工程学院) Guangdong Provincial Key Laboratory of Intelligent Morphing Mechanisms and Adaptive Robotics(广东省智能变形机制与自适应机器人重点实验室) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 机器人数据与评测 :navigation(title,abstract);分类 cs.RO

AI总结 本文提出异步强化学习框架,解决端到端导航中感知与控制频率冲突问题,实现高频率控制与异步感知融合,提升现实环境中航空器的鲁棒性和敏捷性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08292 2026-03-10 cs.NI 78%

Silicone Ethernet (SEth): a Nervous System for Robotic Touch

硅酮以太网(SEth):机器人的触觉神经系统

Mengyao Liu, Dag Malstaf, Jonathan Oostvogels, Sam Michiels, Alexander Badri-Spröwitz, Danny Hughes

专题命中 机器人数据与评测 :robotic(title,abstract)

AI总结 SEth是一种基于导电硅酮基质的无线触觉感知系统,通过无需电池的神经元实现紧凑的计算、通信和能量收集,适用于软机器人和硬机器人的触觉感知与控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07648 2026-03-10 cs.RO cs.AI cs.CV 75%

AtomicVLA: Unlocking the Potential of Atomic Skill Learning in Robots

AtomicVLA:解锁机器人中原子技能学习的潜力

Likui Zhang, Tao Tang, Zhihao Zhan, Xiuwei Chen, Zisheng Chen, Jianhua Han, Jiangtong Zhu, Pei Xu, Hang Xu, Hefeng Wu, Liang Lin, Xiaodan Liang

机构 * Sun Yat-sen University(中山大学) Peng Cheng Laboratory(鹏城实验室) Yinwang Intelligent Technology Co. Ltd.(云网智能技术有限公司)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 AtomicVLA通过原子技能抽象和动态专家组合提升机器人长周期任务的性能

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08433 2026-03-10 cs.RO 74%

FoMo: A Multi-Season Dataset for Robot Navigation in Forêt Montmorency

FoMo:蒙莫朗西森林机器人导航多季节数据集

Matěj Boxan, Gabriel Jeanson, Alexander Krawciw, Effie Daum, Xinyuan Qiao, Sven Lilge, Timothy D. Barfoot, François Pomerleau

专题命中 机器人数据与评测 :navigation(title);分类 cs.RO

AI总结 FoMo数据集通过多季节数据挑战机器人导航算法的鲁棒性,提供丰富的环境变化数据以评估定位与建图技术的适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06824 2026-03-10 cs.RO 74%

A Comprehensive Analysis of the Effects of Network Quality of Service on Robotic Telesurgery

网络服务质量对远程机器人手术影响的全面分析

Zhaomeng Zhang, Seyed Hamid Reza Roodabeh, Homa Alemzadeh

机构 * Department of Electrical and Computer Engineering, University of Virginia(电气与计算机工程系,弗吉尼亚大学)

专题命中 机器人数据与评测 :robotic(title);分类 cs.RO

AI总结 本文通过NetFI工具分析网络服务质量对远程机器人手术任务性能的影响,发现特定运动原语易受网络退化影响,并揭示熟练度与工作负荷的强相关性。

Comments Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07480 2026-03-10 cs.RO 70%

GSAT: Geometric Traversability Estimation using Self-supervised Learning with Anomaly Detection for Diverse Terrains

基于自监督学习与异常检测的几何可 traversability 估计:GSAT

Dongjin Cho, Miryeong Park, Juhui Lee, Geonmo Yang, Younggun Cho

专题命中 机器人数据与评测 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 GSAT通过自监督学习与异常检测,在潜在空间中构建正超球体,实现对不同地形的可通行性估计,提升自主导航的可靠性。

Comments 8 pages, 8 figures, accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26558 2026-03-10 cs.RO 70%

Radio-based Multi-Robot Odometry and Relative Localization

基于无线电的多机器人里程计与相对定位

Andrés Martínez-Silva, David Alejo, Luis Merino, Fernando Caballero

机构 * Service Robotics Laboratory. University Pablo de Olavide(服务机器人实验室。 Pablo de Olavide 大学) Department of System Engineering and Automation(系统工程与自动化系)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于UWB和雷达的多机器人相对定位系统,利用低成本传感器和优化框架实现鲁棒的相对位置估计,并通过SITL模拟和真实数据验证,优于现有闭式方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24099 2026-03-10 cs.CV 70%

Unified Multi-Modal Interactive & Reactive 3D Motion Generation via Rectified Flow

通过修正流实现统一的多模态交互与反应3D运动生成

Prerit Gupta, Shourya Verma, Ananth Grama, Aniket Bera

机构 * Department of Computer Science Purdue University(计算机科学系 哈佛大学)

专题命中 机器人数据与评测 :robotics(abstract);embodied AI(abstract);分类 cs.CV

AI总结 DualFlow通过修正流实现多模态双人运动生成,提升运动质量与节奏同步性。

Comments Under review at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06742 2026-03-10 cs.LG cs.AI cs.RO 67%

Improved Constrained Generation by Bridging Pretrained Generative Models

通过桥梁预训练生成模型实现改进的约束生成

Xiaoxuan Liang, Saeid Naderiparizi, Yunpeng Liu, Berend Zwartsenberg, Frank Wood

机构 * University of British Columbia(不列颠哥伦比亚大学) Inverted AI

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出了一种通过桥梁预训练生成模型实现改进的约束生成方法,通过在可行区域内生成样本并保持现实感,实现了约束满足与采样质量之间的新平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16187 2026-03-10 cs.RO cs.AI 62%

EasyInsert: A Data-Efficient and Generalizable Insertion Policy

EasyInsert: 一种数据高效且具有通用性的插入策略

Guanghe Li, Junming Zhao, Shengjie Wang, Yang Gao

机构 * Tsinghua University(清华大学) Shanghai Qi Zhi Institute(上海启智研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.AI

AI总结 EasyInsert通过delta-pose回归问题实现高效数据收集,提升机器人在杂乱环境中的插入任务泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16053 2026-03-10 cs.RO cs.AI 62%

Compose by Focus: Scene Graph-based Atomic Skills

通过聚焦:基于场景图的原子技能

Han Qi, Changhe Chen, Heng Yang

机构 * School of Engineering and Applied Sciences, Harvard University(哈佛大学工程与应用科学学院) Robotics Department, University of Michigan(密歇根大学机器人系)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.RO、cs.AI

AI总结 本文提出了一种基于场景图的原子技能学习框架,结合图神经网络与扩散式模仿学习,并与视觉-语言模型结合,提升机器人在复杂任务中的稳健性和组合泛化能力。

Comments Acceptance to ICRA 2026. Website: https://computationalrobotics.seas.harvard.edu/SkillComposition/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06704 2026-03-10 cs.CV cs.LG 62%

On the Generalization Capacities of MLLMs for Spatial Intelligence

关于多模态大语言模型在空间智能中的泛化能力

Gongjie Zhang, Wenhao Li, Quanhao Qian, Jiuniu Wang, Deli Zhao, Shijian Lu, Ran Xu

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团) HuPan Lab(虎朋实验室) Nanyang Technological University(南洋理工大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV、cs.LG

AI总结 本文提出Camera-Aware MLLM框架,通过注入相机内参、数据增强和蒸馏几何先验,提升多模态大语言模型在空间任务中的泛化能力与鲁棒性。

Comments ICLR 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02808 2026-03-10 cs.RO cs.AI cs.SY eess.SY 62%

Improving the Resilience of Quadrotors in Underground Environments by Combining Learning-based and Safety Controllers

通过结合学习型控制器和安全控制器提高地下环境中四旋翼的鲁棒性

Isaac Ronald Ward, Mark Paral, Kristopher Riordan, Mykel J. Kochenderfer

机构 * Stanford Intelligent Systems Laboratory, Department of Aeronautics and Astronautics, Stanford University(斯坦福大学航空航天系)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本研究通过结合学习型和安全控制器,提高四旋翼在地下环境中的鲁棒性,实现任务完成与碰撞避免的平衡。

Comments Accepted and awarded best paper at the 11th International Conference on Control, Decision and Information Technologies (CoDIT 2025 - https://codit2025.org/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07748 2026-03-10 cs.HC cs.RO 61%

Directing the Robot: Scaffolding Creative Human-AI-Robot Interaction

引导机器人:构建创造性人机机器人互动

Jordan Aiko Deja, Isidro Butaslac, Nicko Reginio Caluya, Maheshya Weerasinghe

机构 * De La Salle University(德拉萨大学) Nara Institute of Science and Technology(奈良科学技术大学) Ritsumeikan University(立命馆大学) University of Primorska(普里莫尔大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO;robotics(journal_ref)

AI总结 本文提出通过支架概念重新定义人机机器人互动,强调人类作为执行导演的角色,AI作为中介,促进创造力和流畅性。

Comments 4 pages, 1 figure

Journal ref The 3rd InterAI Workshop: Interactive AI for Human-Centered Robotics at ACM CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08232 2026-03-10 cs.RO 57%

A General Lie-Group Framework for Continuum Soft Robot Modeling

连续软机器人建模的通用李群框架

Lingxiao Xun, Benoît Rosa, Jérôme Szewczyk, Brahim Tamadazte

机构 * Sorbonne Université, CNRS UMR 7222, Inserm U1150, ISIR(索邦大学,CNRS UMR 7222,Inserm U1150,ISIR) Université de Strasbourg, CNRS, INSERM, ICube, UMR7357(斯特拉斯堡大学,CNRS,INSERM,ICube,UMR7357)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于李群的通用框架,结合柯西-罗德理论和累积参数化,用于高效建模连续软机器人,解决了传统方法的局限性,并提升了模拟和控制性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07493 2026-03-10 cs.CV 57%

RayD3D: Distilling Depth Knowledge Along the Ray for Robust Multi-View 3D Object Detection

RayD3D: 沿射线蒸馏深度知识以实现鲁棒的多视角3D目标检测

Rui Ding, Zhaonian Kuang, Zongwei Zhou, Meng Yang, Xinhu Zheng, Gang Hua

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 RayD3D通过沿射线蒸馏深度知识,提升多视角3D目标检测的鲁棒性,无需增加计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07414 2026-03-10 cs.CV 57%

QdaVPR: A novel query-based domain-agnostic model for visual place recognition

QdaVPR: 一种基于查询的领域无关视觉位置识别模型

Shanshan Wan, Lai Kang, Yingmei Wei, Tianrui Shen, Haixuan Wang, Chao Zuo

机构 * College of Systems Engineering and the Laboratory for Big Data and Decision(系统工程学院和大数据与决策实验室)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 QdaVPR提出了一种基于查询的领域无关视觉位置识别模型,通过双层对抗学习和三元组监督提升领域不变性和判别能力,有效应对不同领域变化挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17601 2026-03-10 cs.RO 57%

Graph Neural Model Predictive Control for High-Dimensional Systems

图神经网络模型预测控制用于高维系统

Patrick Benito Eberhard, Luis Pabon, Daniele Gammelli, Hugo Buurmeijer, Amon Lahr, Mark Leone, Andrea Carron, Marco Pavone

机构 * Institute for Dynamic Systems and Control, ETH Zürich(瑞士苏黎世联邦理工学院动态系统与控制研究所) Department of Aeronautics and Astronautics, Stanford University(斯坦福大学航空与航天工程系) NVIDIA Research(NVIDIA研究)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出基于图神经网络和结构利用的模型预测控制方法,用于高维系统的实时控制,实现亚厘米级精度的参考跟踪和有效障碍物避障。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23626 2026-03-10 cs.CV 57%

Efficient Domain-Adaptive Multi-Task Dense Prediction with Vision Foundation Models

高效域自适应多任务密集预测与视觉基础模型

Beomseok Kang, Niluthpol Chowdhury Mithun, Mikhail Sizintsev, Han-Pang Chiu, Supun Samarasekera

机构 * SRI International(SRI国际) Seoul National University(首尔国立大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出FAMDA框架,利用视觉基础模型进行自训练,实现高效多任务密集预测,提升领域自适应性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19577 2026-03-10 cs.RO 57%

Smart placement, faster robots-a comparison of algorithms for robot base-pose optimization

智能放置,更快的机器人——机器人基座姿态优化算法的比较

Matthias Mayer, Matthias Althoff

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文比较了四种算法在机器人基座姿态优化中的性能,发现随机梯度下降在成功率上表现最佳,而遗传算法在成本上表现最优。

Comments 10 pages, 3 Figures, 1 Table. Find visualizations and source code at https://cobra.cps.cit.tum.de/tools/rbo. Supplementary Tables can be found at https://www.frontiersin.org/journals/manufacturing-technology/articles/10.3389/fmtec.2025.1642524/full

Journal ref Front. Manuf. Technol. 5:1642524

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07199 2026-03-10 cs.RO 57%

Vision-Guided MPPI for Agile Drone Racing: Navigating Arbitrary Gate Poses via Neural Signed Distance Fields

基于视觉的MPPI用于敏捷无人机竞速:通过神经签名距离场导航任意门姿态

Fangguo Zhao, Hanbing Zhang, Zhouheng Li, Xin Guan, Shuo Li

机构 * College of Control Science and Engineering, Zhejiang University(控制科学与工程学院,浙江大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 本文提出基于视觉的MPPI框架,利用神经签名距离场实现无需参考的敏捷无人机飞行,有效应对动态变化的赛道和门姿态。

详情

展开后加载摘要…

URL PDF HTML 收藏