arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-08 至 2026-07-08 共收录 26 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2604.07607 2026-07-08 cs.RO cs.CV 版本更新 84%

EgoVerse: An Egocentric Human Dataset for Robot Learning from Around the World

EgoVerse:一个用于机器人学习的视点人类数据集

Ryan Punamiya, Simar Kareer, Zeyi Liu, Josh Citron, Ri-Zhao Qiu, Xiongyi Cai, Alexey Gavryushin, Jiaqi Chen, Davide Liconti, Lawrence Y. Zhu, Patcharapong Aphiwetsa, Baoyu Li, Aniketh Cheluva, Pranav Kuppili, Yangcen Liu, Dhruv Patel, Aidan Gao, Hye-Young Chung, Ryan Co, Renee Zbizika, Jeff Liu, Xiaomeng Xu, Haoyu Xiong, Geng Chen, Sebastiano Oliani, Wenkai Xuan, Chenyu Yang, Xi Wang, James Fort, Richard Newcombe, Josh Gao, Jason Chong, Garrett Matsuda, Aseem Doriwala, Marc Pollefeys, Robert Katzschmann, Xiaolong Wang, Shuran Song, Judy Hoffman, Danfei Xu

机构 * Georgia Institute of Technology(佐治亚理工学院) Stanford University(斯坦福大学) University of California San Diego(加州大学圣地亚哥分校) ETH Zürich(苏黎世联邦理工学院) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) Meta Reality Labs Research(Meta现实实验室) Mecka AI Scale AI

专题命中 机器人学习 :robot learning(title,abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 EgoVerse通过统一的数据收集、处理和访问框架,提供丰富的人类操作行为数据,促进机器人学习,并通过大规模研究验证了人类数据与机器人学习目标的一致性对性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 12 篇

2603.15600 2026-07-08 cs.RO cs.AI cs.CL cs.CV 版本更新 89%

From Passive Observer to Active Critic: Reinforcement Learning Elicits Process Reasoning for Robotic Manipulation

从被动观察者到主动批评者:强化学习激发机器人操作的过程推理

Yibin Liu, Yaxing Lyu, Daqi Gao, Zhixuan Liang, Weiliang Tang, Shilong Mu, Xiaokang Yang, Yao Mu

机构 * Shanghai Jiao Tong University(上海交通大学) Northeastern University(东北大学) Xiamen University Malaysia(厦门大学马来西亚分校) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) Xspark AI

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文提出PRIMO R1框架,通过强化学习使视频MLLMs成为主动批评者,提升机器人操作中长期任务的监督准确性,实验表明其在过程推理和零样本泛化方面表现优异。

Comments Accepted to ECCV 2026. 32 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03949 2026-07-08 cs.RO 版本更新 86%

Preference-Calibrated Human-in-the-Loop Reinforcement Learning for Robotic Manipulation

偏好校准的人机协同强化学习用于机器人操作

Zeyi Liu, Guangyao Liu, Yinuo Qu, Yuquan Xue, Bofang Jia, Chunhua Yang, Weihua Gui, Keke Huang, Ziwei Wang

机构 * Central South University(中南大学) Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title);分类 cs.RO

AI总结 提出PACT框架,通过干预隐式偏好信号进行信用重分配和策略对齐,提升人机协同强化学习的样本效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05415 2026-07-08 cs.RO 版本更新 86%

Do Robots Really Need Anthropomorphic Hands? A Comparison of Human and Robotic Hands

机器人真的需要拟人化的手吗?人类手与机器人手的比较

Alexander Fabisch, Wadhah Zai El Amri, Chandandeep Singh, Nicolás Navarro-Guerrero

机构 * Robotics Innovation Center, Deutsches Forschungszentrum für Künstliche Intelligenz GmbH (DFKI)(德意志人工智能研究中心机器人创新中心) Leibniz Universität Hannover, L3S Research Center(汉诺威莱布尼茨大学L3S研究中心)

专题命中 机器人操作 :robotic(title,abstract);robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 本文通过比较人类手与机器人手的生物力学、感知和控制机制,探讨机器人是否需要拟人化手,发现复杂的手部设计并非所有任务所必需,而手部机制的复杂性与执行任务的广度相关,同时指出传感器集成和智能操作策略仍需进一步研究。

Journal ref Journal of Intelligent and Robotic Systems 112 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25126 2026-07-08 cs.RO 版本更新 79%

HANDFUL: Sequential Grasp-Conditioned Dexterous Manipulation with Resource Awareness

HANDFUL: 有意识资源利用的顺序抓取-条件灵活操作

Ethan Foong, Yunshuang Li, Hao Jiang, Gaurav S. Sukhatme, Daniel Seita

机构 * Northwestern University(西北大学) University of Southern California(南加州大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出HANDFUL框架,通过资源感知抓取提升多任务操作的灵活性和鲁棒性,结合仿真与现实验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16622 2026-07-08 quant-ph 版本更新 71%

Temporal steering of entanglement decay with single-shot control

单次控制下纠缠衰减的时间调控

Saumya Ranjan Behera, Kallol Sen, Animesh Sinha Roy, Snigdhadev Ray, Ashutosh Singh, A. R. P. Rau, Urbasi Sinha

专题命中 机器人操作 :manipulation(title)

AI总结 研究通过单次局部酉操作的时机来调控开放量子系统纠缠衰减轨迹,开发含时框架并推导解析条件,实验实现类关联阻尼机制演示相关转变,确立时间调控为退相干控制范例及展示操作优势。

Comments Manuscript: 19 pages, 18 figures, Supplementary: 16 pages, 14 figures. This is a combined version of arXiv:2505.16622 and arXiv:2505.16623 and is closest to the version accepted in Physical Review A

Journal ref Physical Review A 114, 012416 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23128 2026-07-08 cs.RO 版本更新 70%

$π_0$-EqM: Equilibrium Matching for Closed-Loop Vision-Language-Action Control

$\pi_0$-EqM:闭环视觉-语言-动作控制的均衡匹配

Huanming Liu, Congsheng Xu, Jianmin Ji, Yao Mu

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出$\pi_0$-EqM,用均衡匹配解码器替换$\pi_0$中的流匹配专家,在固定预算下提升机器人操作成功率,并发现残差与成功率之间的非单调关系。

Comments Preprint. 5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07162 2026-07-08 cs.RO 版本更新 70%

First Plan Then Evaluate: Multi-Target Planning with Post-Planning Success Evaluation Improves Learning-Based Grasping Pipelines

先规划再评估:通过规划后成功评估的多目标规划改进基于学习的抓取管道

Martin Matak, Mohanraj Devendran Shanthi, Karl Van Wyk, Tucker Hermans

机构 * NVIDIA

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究自主多指抓取问题,提出先规划到一组抓取目标,再由评估器估计成功可能性,机器人执行最可能成功轨迹的框架,该方法在多方面优于传统框架且能推广到新环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30243 2026-07-08 cs.RO 版本更新 57%

KYON: Semi-Modular Wheel-Legged Quadruped With Agile Bimanual Capability

KYON: 具有敏捷双臂能力的半模块化轮腿四足机器人

Luca Rossini, Arturo Laurenzi, Francesco Ruscelli, Yifang Zhang, Jingcheng Jiang, Giovanbattista Gravina, Lorenzo Baccelliere, Corrado Burchielli, Stefano Cordasco, Luca Muratore, Nikos Tsagarakis

机构 * Humanoids and Human Centered Mechatronics, Fondazione Istituto Italiano di Tecnologia(人机一体化机械系统,意大利理工研究院) Advanced Robotics Facility, Fondazione Istituto Italiano di Tecnologia(先进机器人设施,意大利理工研究院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 提出KYON半模块化轮腿四足机器人,通过基座致动器与传动机构降低远端惯量,结合全身控制与强化学习策略实现动态运动与双臂操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07997 2026-07-08 cs.HC cs.LG 版本更新 57%

A Comparative Study of EMG- and IMU-based Gesture Recognition at the Wrist and Forearm

基于肌电图和惯性测量单元的手腕和前臂手势识别比较研究

Soroush Baghernezhad, Elaheh Mohammadreza, Vinicius Prado da Fonseca, Ting Zou, Xianta Jiang

专题命中 机器人操作 :robotics(abstract);分类 cs.LG

AI总结 研究基于IMU信号的手势识别潜力,通过比较不同肌肉群,发现其含足够信息用于静态手势识别,肌腱诱导微运动是主要贡献因素,该研究为多领域手势识别及假肢可用性提升提供新可能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10758 2026-07-08 cs.CR 版本更新 56%

Agents at Risk: How Users Unwittingly Undermine LLM Safety

处于风险中的智能体:用户如何在不知情的情况下破坏大语言模型的安全性

Fengchao Chen, Tingmin Wu, Van Nguyen, Surya. Nepal, Carsten Rudolph

专题命中 机器人操作 :manipulation(abstract,comments)

AI总结 研究基于大语言模型的智能体安全问题,介绍用户中继上下文操纵攻击,通过让良性用户在请求中传递对抗性内容,实验表明该攻击在多种防御下优于提示注入基线,揭示当前智能体框架设计缺陷。

Comments User-relayed Context Manipulation; LLM-based Agents; Agent Security; Human Factors in Cybersecurity; Web-Use Agents; Planning Agents

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12174 2026-07-08 physics.optics cond-mat.mes-hall cond-mat.mtrl-sci 版本更新 50%

Tunable Polariton Canalization in Natural van der Waals Oxide

自然范德瓦尔斯氧化物中的可调极子通道化

H. Shiravi, W. Zheng, D. A. Rhodes, L. Balicas, H. D. Zhou, G. X. Ni

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究通过红外纳米成像揭示了alpha-V2O5中平面双曲性,实现无额外处理的极子单向传播,展示了可调极子通道化的新形式。

Comments The authors request withdrawal of this manuscript because one co-author does not agree with its submission in its current form. The manuscript does not reflect the authorized consensus of all contributors, and we therefore request its withdrawal pending resolution of the authorship approval

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08906 2026-07-08 quant-ph physics.atom-ph physics.optics 版本更新 50%

A 10 Megahertz Spatial Light Modulator

一个10兆赫兹的空间光调制器

Xin Wei, Zeyang Li, Abhishek V. Karve, Adam L. Shaw, David I. Schuster, Jonathan Simon

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究旨在解决光场快速可编程整形工具缺乏的问题,介绍一种基于宽带光相位调制器和高分辨率二维光谱仪的新空间光调制器,可实现兆赫兹速率等多种功能,为物质快速光学操纵开辟新视野。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 3 篇

2603.21046 2026-07-08 cs.CV cs.AI 版本更新 76%

SpatialFly: Implicit 3D Prior-Guided Visual Reparameterization for Continuous UAV Vision-and-Language Navigation

SpatialFly:基于几何的表示对齐用于城市环境中无人机视觉与语言导航

Wen Jiang, Kangyao Huang, Li Wang, Wang Xu, Wei Fan, Jinyuan Liu, Shaoyu Liu, Hanfang Liang, Hongwei Duan, Bin Xu, Xiangyang Ji, Huaping Liu

机构 * School of Mechanical Engineering, Beijing Institute of Technology(北京理工大学机械工程学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Tsinghua University(清华大学) Department of Automation, Tsinghua University(清华大学自动化系) School of Artificial Intelligence, Xidian University(西安电子科技大学人工智能学院) Jianghan University(江汉大学)

专题命中 具身导航 :navigation(title);分类 cs.AI、cs.CV

AI总结 本文提出SpatialFly框架,通过几何引导的2D表示对齐机制,解决无人机在复杂3D环境中的视觉与语言导航问题,实验表明其在路径对齐和运动稳定性方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20182 2026-07-08 cs.RO cs.MA 版本更新 57%

IndoorR2X: Indoor Robot-to-Everything Coordination with LLM-Driven Planning

IndoorR2X: 基于大语言模型的室内机器人与万物协调

Fan Yang, Soumya Teotia, Shaunak A. Mehta, Prajit KrisshnaKumar, Quanting Xie, Jun Liu, Yueqi Song, Wenkai Li, Atsunori Moteki, Kanji Uchino, Yonatan Bisk

机构 * Fujitsu Research(富士通研究所) Carnegie Mellon University(卡内基梅隆大学)

专题命中 具身导航 :world model(abstract);分类 cs.RO

AI总结 IndoorR2X通过整合移动机器人和静态物联网设备的观测数据,构建全局语义状态,实现可扩展的场景理解、减少冗余探索并利用大语言模型进行高层协调,提升多机器人系统的效率和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22838 2026-07-08 cs.DB cs.IR 版本更新 50%

OrchANN: Hierarchical Orchestration for Skewed Out-of-Core Vector Search

OrchANN:用于倾斜的核外向量搜索的分层编排

Lizheng Chen, Pinhuan Wang, Shaonan Ma, Jie Zhang, Qing Wang, Zhengyi Yang, Heng Zhang, Mingxing Zhang, Fan Yang, Guihai Chen, Chen Tian, Chengying Huan

专题命中 具身导航 :navigation(abstract)

AI总结 研究在十亿规模下近似最近邻搜索的核外问题,提出OrchANN引擎,通过编排查询路由等,在严格内存限制下存储簇并利用图抽象,提升了QPS并降低延迟,比现有基线在准确性和效率平衡上表现更优。

Comments Substantially revised version; updated title, author order, and abstract

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 机器人基础模型 2 篇

2602.19710 2026-07-08 cs.CV cs.LG cs.RO 版本更新 71%

PoseVLA: Universal Pose Pretraining for Generalizable Vision-Language-Action Policies

面向通用视觉-语言-动作策略的通用姿态预训练

Haitao Lin, Hanyang Yu, Jingshun Huang, He Zhang, Yonggen Ling, Ping Tan, Xiangyang Xue, Yanwei Fu

机构 * Tencent Robotics X(腾讯机器人X) Futian Laboratory(福田实验室) The Hong Kong University of Science and Technology(香港科学与技术大学) Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 机器人基础模型 :robotic(abstract);robotics(comments,journal_ref);分类 cs.RO、cs.CV、cs.LG

AI总结 本文提出Pose-VLA,通过分离预训练和后训练阶段,解决视觉-语言-动作模型中的特征坍塌和训练效率问题,实现通用3D空间先验提取与机器人特定动作空间的高效对齐。

Comments Accepted to Robotics: Science and Systems (RSS) 2026. Project website: https://hetolin.github.io/PoseVLA

Journal ref Robotics: Science and Systems, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01642 2026-07-08 cs.RO 版本更新 70%

FailSafe: Reasoning and Recovery from Failures in Vision-Language-Action Models

FailSafe: 视觉-语言-动作模型中的失败推理与恢复

Zijun Lin, Jiafei Duan, Haoquan Fang, Dieter Fox, Ranjay Krishna, Cheston Tan, Bihan Wen

机构 * Nanyang Technological University(南洋理工大学) Centre for Frontier AI Research, A*STAR(A*STAR前沿人工智能研究中心) Allen Institute for AI(艾伦人工智能研究所) University of Washington(华盛顿大学)

专题命中 机器人基础模型 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出FailSafe系统,自动生成多样化失败案例及可执行恢复动作,微调LLaVA-OV-7B构建FailSafe-VLM,使机器人检测并恢复失败,在ManiSkill任务上平均提升三个VLA模型性能达22.6%。

Comments IROS 2026. Project Page: https://jimntu.github.io/FailSafe

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 模仿学习与强化学习 2 篇

2504.16595 2026-07-08 cs.RO cs.LG 版本更新 73%

HERB: Human-augmented Efficient Reinforcement learning for Bin-packing

HERB:用于装箱的人类增强高效强化学习

Gojko Perovic, Nuno Ferreira Duarte, Atabak Dehban, Gonçalo Teixeira, Egidio Falotico, José Santos-Victor

机构 * BioRobotics Institute, Scuola Superiore Sant’Anna, Pisa, Italy, and with the Department of Excellence in Robotics and AI, Scuola Superiore Sant’Anna, Pisa, Italy(生物机器人研究所,圣安娜高等学院,意大利比萨,以及与机器人与人工智能卓越部门,圣安娜高等学院,意大利比萨) Institute for Systems and Robotics, Instituto Superior Técnico, Universidade de Lisboa(系统与机器人研究所,技术高等学院,里斯本大学)

专题命中 模仿学习与强化学习 :robotics(abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 研究针对不规则物体装箱问题,提出HERB人类增强RL框架,结合人类示范与RL探索确定物体放置,实验表明该方法在效率、延迟上优于其他方法,且策略更稳定、似人类,还验证了现实可行性。

Comments 8 pages, 8 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02965 2026-07-08 cs.LG cs.SY eess.SP eess.SY stat.ML 版本更新 57%

Joint Energy Management and Coordinated AIGC Workload Scheduling for Distributed Data Centers: A Diffusion-Aided Reward Shaping Approach

分布式数据中心的联合能源管理与协同AIGC工作负载调度:一种扩散辅助奖励塑造方法

Yang Fu, Peng Qin, Liming Chen, Zihao Zhang, Hao Yu, Yifei Wang

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.LG

AI总结 针对AIGC在数据中心带来的能源管理与工作负载调度挑战,提出联合调度框架,考虑多种能源资源,制定系统效用最大化问题。因奖励稀疏限制DRL算法,开发扩散模型辅助奖励塑造方法,实验表明该方案能有效适应波动和异质性,实现高效学习收敛和系统效用。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 人机交互与遥操作 1 篇

2604.20557 2026-07-08 cs.RO 版本更新 61%

Passive Variable Impedance For Shared Control

被动可变阻抗用于共享控制

Maximilian Mühlbauer, Nepomuk Werner, Ribin Balachandran, Thomas Hulin, João Silvério, Freek Stulp, Alin Albu-Schäffer

机构 * German Aerospace Center (DLR), Robotics and Mechatronics Center(德国航空航天中心(DLR),机器人与机电中心)

专题命中 人机交互与遥操作 :robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本文研究了共享控制中可变刚度和控制器仲裁的稳定性,通过加权叠加输出力矩实现整体框架,解决闭环系统中的被动性问题,验证了方法的有效性。

Comments submitted for publication at the IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 机器人数据与评测 4 篇

2606.00550 2026-07-08 cs.HC cs.ET cs.RO 版本更新 83%

A Four-Tier Communication Architecture and Sim-to-Real Validation of a Graphical Open-Source Platform for Robotic Engineering Education

用于机器人工程教育的四层通信架构与图形化开源平台的仿真到现实验证

Thien Tran, Khang Duong, Minh Tran, Jonathan Kua, Thuong Hoang, Jiong Jin

机构 * Deakin University(德金大学) RMIT University(皇家墨尔本理工大学) Swinburne University of Technology(斯威本科技大学)

专题命中 机器人数据与评测 :robotic(title,abstract);robotics(abstract);分类 cs.RO

AI总结 针对大学实验室中机械臂教育规模化面临的商业数字孪生成本高和ROS门槛高的问题,提出一种四层通信架构,基于图形化开源平台(GOSP)实现虚拟环境与物理机器人的数据桥接,并通过仿真到现实验证其硬件无关的可行性。

Comments 4 pages, 4 figures, accepted paper on the 24th IEEE International Conference on Industrial Informatics (INDIN), 26-29 July, 2026, Melbourne, Australia

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28757 2026-07-08 cs.CV cs.RO 版本更新 81%

A Physics-Grounded Benchmark for Multi-Agent Dynamics in World Models

基于物理的多智能体动力学世界模型基准

Nuo Chen, Lulin Liu, Zihao Li, Ziyao Zeng, Zihao Zhu, Wenyan Cong, Junyuan Hong, Yunhao Yang, Zhengzhong Tu, Yan Wang, Boris Ivanovic, Marco Pavone, Zhangyang Wang, Yang Zhou, Zhiwen Fan

机构 * Texas A&M University(德克萨斯大学) University of Minnesota(明尼苏达大学) Marquette University(马奎特大学) Yale University(耶鲁大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) Massachusetts General Hospital(麻省总医院) Harvard Medical School(哈佛医学院) NVIDIA(英伟达) Stanford University(斯坦福大学)

专题命中 机器人数据与评测 :world model(title,abstract);分类 cs.RO、cs.CV

AI总结 提出CrashTwin框架,通过多智能体碰撞场景数据集和校准无关重建流程,从时空一致性、动量与动能守恒、世界动力学完整性三个维度评估世界模型的物理可信度。

Comments 34 pages, 9 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17649 2026-07-08 cs.CV cs.AI cs.RO 版本更新 67%

SWITCH: Benchmarking Modeling and Handling of Tangible Interfaces in Long-horizon Embodied Scenarios

SWITCH:在长时程具身场景中评估和处理具象接口的基准测试

Juntao Cheng, Wanyue Zhang, Zhiwei Yu, Shuo Ren, Zheqi He, Shaoxuan Xie, Guocai Yao, Jieru Lin, Börje F. Karlsson, Jiajun Zhang

专题命中 机器人数据与评测 :world model(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 SWITCH基准测试通过1170个时间交互视频,评估具象接口在真实第一人称环境中的闭环交互推理,揭示多模态模型在细粒度视觉-时间感知、结果验证和错误恢复方面的不足。

Comments The dataset is available at https://huggingface.co/datasets/BAAI-Agents/SWITCH

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22851 2026-07-08 cs.CV cs.CL cs.RO 版本更新 62%

EgoDyn-Bench: Evaluating Ego-Motion Understanding in Vision-Centric Foundation Models for Autonomous Driving

EgoDyn-Bench:评估面向自动驾驶的视觉中心基础模型中的自我运动理解

Finn Rasmus Schäfer, Yuan Gao, Dingrui Wang, Thomas Stauner, Stephan Günnemann, Mattia Piccinini, Sebastian Schmidt, Johannes Betz

机构 * Professorship of Autonomous Vehicle Systems, Technical University of Munich, Munich, Germany(自动驾驶车辆系统教授职位,慕尼黑技术大学,德国慕尼黑) Bayerische Motoren Werke AG, Munich, Germany(巴伐利亚发动机有限公司,德国慕尼黑) Data Analytics and Machine Learning Group, Technical University of Munich, Munich, Germany(数据分析与机器学习小组,慕尼黑技术大学,德国慕尼黑)

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.RO、cs.CV

AI总结 本文提出EgoDyn-Bench基准,用于评估视觉中心基础模型的自我运动理解能力,发现模型在将物理逻辑与视觉感知结合时存在结构性缺陷,通过显式轨迹编码可恢复物理一致性。

Comments 36 Pages, Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

8. 其他机器人 1 篇

2510.07514 2026-07-08 cs.RO 版本更新 57%

HJCD-IK: GPU-Accelerated Inverse Kinematics through Batched Hybrid Jacobian Coordinate Descent

HJCD-IK:通过批处理混合雅可比坐标下降实现GPU加速的逆运动学

Cael Yasutake, Andrew H. Liu, Zachary Kingston, Brian Plancher

机构 * Columbia University(哥伦比亚大学) Purdue University(普渡大学) Barnard College, Columbia University(巴纳德学院,哥伦比亚大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 研究机器人逆运动学问题,提出基于GPU加速、采样的混合求解器HJCD-IK,通过结合方向感知贪婪坐标下降初始化、雅可比优化和并行碰撞滤波器,在速度和精度上比现有求解器有显著提升,且能找到无碰撞解决方案并开源代码。

Comments Accepted to IROS 2026. 8 pages, 6 figures, 3 tables, 4 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏