arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-10 至 2026-06-10 共收录 32 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2606.05645 2026-06-10 cs.RO 版本更新 57%

Discrete-WAM: Unified Discrete Vision-Action Token Editing for World-Policy Learning

Discrete-WAM:面向世界-策略学习的统一离散视觉-动作标记编辑

Ziyang Yao, Haochen Liu, Yuncheng Jiang, Zeyu Zhu, Zibin Guo, Jingru Wang, Tianle Liu, Jianwei Cui, Kuiyuan Yang, Hongwei Xie, Jingwei Zhao, Guang Chen, Hangjun Ye

机构 * Xiaomi EV(小米电动车)

专题命中 机器人学习 :world model(abstract);分类 cs.RO

AI总结 提出Discrete-WAM,通过将未来视觉状态和自车动作对齐为离散标记,构建统一离散扩散框架,实现世界建模、世界-动作策略和分层决策策略的联合学习,支持可控生成和反事实推理,提升自动驾驶决策可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 13 篇

2505.01458 2026-06-10 cs.RO cs.AI 版本更新 93%

A Survey of Robotic Navigation and Manipulation with Physics Simulators in the Era of Embodied AI

具身智能时代基于物理模拟器的机器人导航与操作综述

Lik Hang Kenny Wong, Xueyang Kang, Kaixin Bai, Jianwei Zhang

机构 * Department of Computer Science, City University of Hong Kong(城市大学计算机科学系) School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院) Department of Informatics, Universität Hamburg(汉堡大学信息学院)

专题命中 机器人操作 :embodied AI(title,abstract);manipulation(title,abstract);navigation(title,abstract);robotic(title)

AI总结 本文综述了物理模拟器在缩小具身智能中导航与操作的模拟到现实差距方面的关键特性、任务支持及硬件需求,并提供了基准数据集、指标、平台和方法资源。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20242 2026-06-10 cs.CY cs.AI cs.RO 版本更新 79%

BadRobot: Jailbreaking Embodied LLM Agents in the Physical World

BadRobot: 在物理世界中越狱具身LLM智能体

Hangtao Zhang, Chenyu Zhu, Xianlong Wang, Ziqi Zhou, Changgan Yin, Minghui Li, Lulu Xue, Yichen Wang, Shengshan Hu, Aishan Liu, Peijin Guo, Leo Yu Zhang

机构 * Huazhong University of Science and Technology(华中科技大学) Beihang University(北航) Griffith University(格里菲斯大学)

专题命中 机器人操作 :embodied AI(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 提出BadRobot攻击范式,利用LLM在机器人系统中的操纵、语言输出与物理动作的错位以及世界知识缺陷三个漏洞,通过语音交互使具身LLM执行有害行为,并在基准测试中验证了有效性。

Comments Accepted to ICLR 2025. Please cite the conference version. Project page: https://Embodied-LLMs-Safety.github.io

Journal ref International Conference on Learning Representations (ICLR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08213 2026-06-10 cs.RO 版本更新 77%

HandCept: A Visual-Inertial Fusion Framework for Accurate Proprioception in Dexterous Hands

HandCept: 用于灵巧手精确本体感知的视觉-惯性融合框架

Huang Junda, Honghao Guo, Hao Wu, Zhengyang Liu, Marcelo H Ang, Jianshu Zhou

机构 * The Chinese University of Hong Kong(香港中文大学) National University of Singapore(新加坡国立大学)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出HandCept,首个视觉-惯性本体感知框架,通过零样本学习和无延迟扩展卡尔曼滤波融合腕部RGB-D相机与9轴IMU,实现2°-4°关节角估计误差且无漂移,优于纯视觉或纯惯性方法。

Comments 8 pages, 7 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25371 2026-06-10 cs.RO 版本更新 70%

FOUND-IT: Foundation-model-first Task-driven 3D Scene Graphs with Granularity on Demand

FOUND-IT: 基于基础模型优先、按需粒度的任务驱动3D场景图

Dominic Maggio, Nicolas Gorlo, Kris Hauser, Luca Carlone

机构 * Laboratory for Information & Decision Systems, Massachusetts Institute of Technology(信息与决策系统实验室,麻省理工学院) Samsung Research America(三星美国研究院)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 提出首个基于未标定单目相机实时构建任意室内外环境分层任务驱动3D场景图的方法,通过几何基础模型和可调整粒度支持动态任务,并在ASHiTA SG3D基准上提升79%准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05291 2026-06-10 cs.RO 版本更新 70%

Online Self-Training for Co-Adaptation in Hierarchical Diffusion Policies

层次扩散策略中的在线自训练协同适应

Clemence Grislain, Mathilde Kappel, Olivier Sigaud, Mohamed Chetouani

机构 * ISIR, Sorbonne Université, CNRS(ISIR,索邦大学,国家科学研究中心)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出ORCHID自训练框架,通过环境反馈过滤轨迹并蒸馏回规划器和控制器,实现层次扩散策略的在线稳定改进,在CALVIN基准上轻量模型超越纯离线方法。

Comments Accepted at ICML 2026 Workshop on Decision-Making from Offline Datasets to Online Adaptation (DEMO)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05886 2026-06-10 cs.RO 版本更新 70%

Rod models in continuum and soft robot control: a review

连续体和软体机器人控制中的杆模型:综述

Carlo Alessi, Camilla Agabiti, Daniele Caradonna, Cecilia Laschi, Federico Renda, Egidio Falotico

机构 * Istituto Italiano di Tecnologia(意大利技术研究院) The BioRobotics Institute(生物机器人研究所) Department of Excellence in Robotics and AI(机器人与人工智能卓越部门)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 本文综述了杆模型在连续体和软体机器人建模与控制中的应用,涵盖数学基础、机器人建模及控制策略,并讨论了其优势、局限和未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06493 2026-06-10 cs.RO cs.AI cs.LG 版本更新 67%

HANDOFF: Humanoid Agentic Task-Space Whole-Body Control via Distilled Complementary Teachers

HANDOFF: 通过蒸馏互补教师实现人形机器人任务空间全身控制

Lizhi Yang, Junheng Li, Nehar Poddar, Yiling Hou, Gio Huh, Robert Griffin, Georgia Gkioxari, Aaron Ames

机构 * California Institute of Technology(加州理工学院) The Institute for Human & Machine Cognition(人机认知研究院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 提出HANDOFF框架,通过多教师KL蒸馏和上下文门控机制,将全身运动跟踪、行走和跌倒恢复三个专家策略融合为混合专家学生策略,实现基于紧凑显式接口的全身控制,在Unitree G1上达到先进的速度跟踪性能并扩展了操作工作空间。

Comments 22 pages, 9 figures, Project page: https://lzyang2000.github.io/HANDOFF/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20850 2026-06-10 cs.CV cs.RO 版本更新 62%

Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves

Glove2Hand:从多模态传感手套合成自然的手-物体交互

Xinyu Zhang, Ziyi Kou, Chuan Qin, Mia Huang, Ergys Ristani, Ankit Kumar, Lele Chen, Kun He, Abdeslam Boularias, Li Guan

机构 * Meta Reality Labs(Meta现实实验室) Rutgers University(罗格斯大学)

专题命中 机器人操作 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 提出Glove2Hand框架,将多模态传感手套视频转化为逼真的裸手,并保留物理交互动态;引入3D高斯手模型和扩散手恢复器,创建HandSense数据集,提升下游任务性能。

Comments CVPR 2026 Highlight. This version includes the motion retarget process in the appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09203 2026-06-10 cs.RO 版本更新 57%

Deterministic Execution of ROS 2 Applications via Lingua Franca

通过Lingua Franca实现ROS 2应用的确定性执行

Harun Teper, Shaokai Lin, Shulu Li, Edward A. Lee, Jian-Jia Chen

机构 * TU Dortmund University(多特蒙德工业大学) University of California, Berkeley(加州大学伯克利分校) RWTH Aachen University(亚琛工业大学)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 提出框架将未修改的ROS 2应用转换为Lingua Franca程序,利用逻辑时间实现确定性执行,解决ROS 2中回调执行顺序和消息交织的非确定性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00745 2026-06-10 cs.CL cs.AI cs.GT cs.IR econ.TH 版本更新 57%

Dynamics of Adversarial Attacks on Large Language Model-Based Search Engines

基于大型语言模型的搜索引擎对抗攻击动力学

Xiyang Hu

机构 * Arizona State University(亚利桑那州立大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文将排名操纵攻击建模为无限重复囚徒困境,分析合作维持条件,发现降低攻击成功率可能反而激励攻击,防御措施在某些情况下无效。

Comments New Frontiers in Game-Theoretic Learning Workshop, International Conference on Machine Learning (ICML) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.03018 2026-06-10 cs.RO cs.SY eess.SY 版本更新 57%

RAPTOR: Rapid Aerial Pickup and Transport of Objects by Robots

RAPTOR: 机器人快速空中抓取与运输物体

Aurel Appius, Erik Bauer, Marc Blöchlinger, Aashi Kalra, Robin Oberson, Arman Raayatsanati, Pascal Strauch, Sarath Suresh, Marco von Salis, Robert K. Katzschmann

机构 * Soft Robotics Lab, ETH Zurich, Switzerland(软机器人实验室,苏黎世联邦理工学院,瑞士)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 提出一种结合软材料Fin Ray夹爪和Fast DDS中间件的四旋翼平台RAPTOR,实现高速飞行中对不同几何形状物体的灵活抓取,平均抓取成功率83%,有效载荷达先前工作的四倍。

Comments 7 pages, 10 figures, accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2022. Video: https://youtu.be/KHkBlBABsC8 Project page: https://srl-ethz.github.io/RAPTOR

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21594 2026-06-10 physics.acc-ph 版本更新 50%

Theoretical and experimental studies of energy modulation to demodulation in seeded free-electron lasers

种子型自由电子激光中能量调制到解调的理论与实验研究

Hanxiang Yang, Nanshun Huang, Zipeng Liu, Zhangfeng Gao, Shengbin Ye, Wencai Cheng, Shudong Zhou, Jinya Chen, Cheng Yu, Wei Zhang, Tao Liu, Haixiao Deng

专题命中 机器人操作 :manipulation(abstract)

AI总结 通过两个调制器与可调移相器,研究种子型FEL中能量调制与解调,π相位延迟可抑制残余调制,实验验证了激光诱导能量调制的抑制。

Comments 15 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09179 2026-06-10 cond-mat.mes-hall 版本更新 50%

Observation of localization reversal and harmonic generation in nonlinear non-Hermitian skin effect

非线性非厄米趋肤效应中的局域反转与谐波产生观测

Junyao Wu, Rui-Chang Shen, Li Zhang, Fujia Chen, Bingbing Wang, Hongsheng Chen, Yihao Yang, Haoran Xue

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究非线性对非厄米趋肤效应的影响,发现非线性诱导的点隙拓扑相变导致趋肤模式局域反转,并在非线性微波超材料中实验验证。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 5 篇

2603.08975 2026-06-10 math.NA cs.NA 版本更新 71%

Overlapping Schwarz Preconditioners for Pose-Graph SLAM in Robotics

机器人位姿图SLAM中的重叠型Schwarz预条件子

Stephan Köhler, Oliver Rheinbach, Yue Xiang Tee, Sebastian Zug

专题命中 具身导航 :robotics(title)

AI总结 提出基于GDSW型能量最小化粗空间的两层重叠Schwarz预条件子,用于SLAM位姿图优化中的稀疏线性系统,数值实验表明其具有数值可扩展性。

Comments 26 pages, 8 figures. To be submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04195 2026-06-10 cs.AI 版本更新 57%

Constructing coherent spatial memory in LLM agents through graph rectification

通过图修正构建LLM智能体中的连贯空间记忆

Puzhen Zhang, Xuyang Chen, Yu Feng, Yuhan Jiang, Liqiu Meng

机构 * Chair of Cartography and Visual Analytics(制图学与视觉分析教授会)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 提出LLM-MapRepair框架,通过版本控制和边影响评分检测并修正增量构建的导航图中的结构不一致性,在多个基准上显著提升节点和边召回率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04397 2026-06-10 cs.SE cs.IR 版本更新 50%

Context-as-AI-Service: Surfacing Cross-File Dependency Chains for LLM-Generated Developer Documentation

上下文即服务:为LLM生成的开发者文档揭示跨文件依赖链

Ameya Gawde, Vyzantinos Repantis, Harshvardhan Singh, Lucy Moys

专题命中 具身导航 :navigation(abstract)

AI总结 提出Context-as-a-Service (CaaS)检索层,通过索引代码库并支持关键词与语义搜索,帮助LLM代理在生成或审查文档时追踪跨文件依赖链,实验表明CaaS能发现基线遗漏的错误并减少时间和输入令牌消耗。

Comments 8 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07529 2026-06-10 eess.SY cs.SY math.OC 版本更新 50%

Stochastic Differential Dynamic Programming for Trajectory Optimization under Partial Observability

部分可观测下轨迹优化的随机微分动态规划

Masahiro Fujiwara, Naoya Ozaki

专题命中 具身导航 :navigation(abstract)

AI总结 提出一种随机微分动态规划算法,用于在部分可观测条件下联合优化标称控制序列和反馈增益,显式考虑协方差传播对标称轨迹的依赖,生成导航感知且鲁棒的轨迹。

Comments Revised version; 38 pages, 13 figures; submitted to the Journal of Guidance, Control, and Dynamics

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04217 2026-06-10 eess.SP 版本更新 50%

Towards 6G Single-Anchor Vehicle Localization Exploiting Radio-Reflective Road Markings in Tunnel Environments

面向隧道环境中利用无线电反射路面标记的6G单锚车辆定位

Lorenzo Italiano, Mattia Brambilla, Monica Nicoli

专题命中 具身导航 :navigation(abstract)

AI总结 针对隧道等无GNSS区域,提出一种利用近场传播和被动反射结构的单锚车辆定位方法JAVELIN,通过张量参数估计和递归贝叶斯跟踪实现亚米级定位。

Comments Currently submitted to IET-ITS

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 具身推理 2 篇

2512.14614 2026-06-10 cs.CV cs.GR 版本更新 79%

WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling

WorldPlay:面向实时交互式世界建模的长期几何一致性

Wenqiang Sun, Haiyu Zhang, Haoyuan Wang, Junta Wu, Zehan Wang, Zhenwei Wang, Yunhong Wang, Jun Zhang, Tengfei Wang, Chunchao Guo

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 提出WorldPlay流式视频扩散模型,通过双重动作表示、重构上下文记忆和上下文强制蒸馏方法,实现实时交互式世界建模并保持长期几何一致性,生成24 FPS的720p长视频。

Comments project page: https://3d-models.hunyuan.tencent.com/world/, demo: https://3d.hunyuan.tencent.com/sceneTo3D, code: https://github.com/Tencent-Hunyuan/HY-WorldPlay

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07413 2026-06-10 cs.RO 版本更新 70%

Going with the Flow: Koopman Behavioral Models as Pseudo Planners for Visuo-Motor Dexterity

随流而行:Koopman行为模型作为视觉运动灵巧性的伪规划器

Yunhai Han, Jiaqi Fu, Linhao Bai, Ziyu Xiao, Zhaodong Yang, Yogita Choudhary, Krishna Jha, Chuizheng Kong, Shreyas Kousik, Harish Ravichandar

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 具身推理 :world model(abstract,abstract_cn);分类 cs.RO

AI总结 提出统一行为模型(UBM),将灵巧技能建模为耦合动力系统,确保时间一致性;基于Koopman算子实现线性潜空间,通过在线重规划实现反应性和适应性,在模拟和真实任务中达到或超越现有方法。

Comments Website: https://k-ubm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 机器人基础模型 2 篇

2508.13446 2026-06-10 cs.RO 版本更新 70%

CAST: Counterfactual Labels Improve Instruction Following in Vision-Language-Action Models

CAST: 反事实标签提升视觉-语言-动作模型中的指令跟随能力

Catherine Glossop, William Chen, Arjun Bhorkar, Dhruv Shah, Sergey Levine

机构 * University of California Berkeley(加州大学伯克利分校) Princeton University(普林斯顿大学)

专题命中 机器人基础模型 :manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 针对VLA模型难以遵循细粒度指令的问题,提出利用视觉语言模型生成反事实标签增强数据集,提升语言基础多样性,实验表明该方法在导航和操作任务中显著提升指令跟随成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14836 2026-06-10 cs.CV cs.RO 版本更新 62%

QDepth-VLA: Quantized Depth Prediction as Auxiliary Supervision for Vision-Language-Action Models

QDepth-VLA:量化深度预测作为视觉-语言-动作模型的辅助监督

Yixuan Li, Yuhui Chen, Mingcai Zhou, Haoran Li, Zhengtao Zhang, Dongbin Zhao

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beijing Zhongke Huiling Robot Technology Co.(北京中科创联机器人科技有限公司)

专题命中 机器人基础模型 :manipulation(abstract);分类 cs.RO、cs.CV

AI总结 提出QDepth-VLA框架,通过辅助深度预测任务增强VLA模型的空间感知与推理能力,在仿真和真实任务中提升操作性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 模仿学习与强化学习 1 篇

2606.03963 2026-06-10 cs.RO cs.AI 版本更新 81%

AgenticRL: Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation

面向视觉条件的无人机导航的自优化智能体强化学习

Roohan Ahmed Khan, Yasheerah Yaqoot, Amir Atef Habel, Muhammad Ahsan Mustafa, Dzmitry Tsetserukou

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 模仿学习与强化学习 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 提出AgenticRL框架,利用多模态GPT智能体自动设计奖励函数、通过闭环自改进优化策略,在多种无人机导航任务中提升性能并实现高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 人机交互与遥操作 2 篇

2605.12804 2026-06-10 cs.RO 版本更新 57%

BiPneu: Design and Control of a Bipolar-Pressure Pneumatic System for Soft Robots

BiPneu:用于软体机器人的双极气压气动系统的设计与控制

Yu Mei, Xinyu Zhou, Vedant Naik, Alan Gao, Xiaobo Tan

机构 * Department of Electrical and Computer Engineering, Michigan State University(电气与计算机工程系,密歇根州立大学)

专题命中 人机交互与遥操作 :robotic(abstract);分类 cs.RO

AI总结 提出一种可扩展、高性价比的多通道双极气压气动系统BiPneu,并设计基于混合电-气动模型的双模式滑模控制器(DM-SMC),实现宽范围、精确、快速的压力调节,在软体机器人应用中显著优于MPC和PID控制器。

Comments Full Version of BiPenu, including the supplementary materials

Journal ref IEEE/ASME Transactions on Mechatronics, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19936 2026-06-10 cs.CV 版本更新 57%

CapStARE: Capsule-based Sequential Architecture for Robust and Efficient Gaze Estimation

CapStARE: 基于胶囊的序列架构实现鲁棒高效的目光估计

Miren Samaniego, Igor Rodriguez, Elena Lazkano

机构 * University of the Basque Country(巴斯克大学)

专题命中 人机交互与遥操作 :robotics(abstract);分类 cs.CV

AI总结 提出CapStARE,结合冻结ConvNeXt骨干、注意力路由胶囊和双GRU解码器,在ETH-XGaze等数据集上实现实时高精度目光估计,兼顾空间鲁棒性与计算效率。

Comments Preprint for Patter Recognition Journal

详情

展开后加载摘要…

URL PDF HTML 收藏

8. 机器人数据与评测 5 篇

2605.06234 2026-06-10 cs.RO cs.HC 版本更新 85%

RobotEQ: Transitioning from Passive Intelligence to Active Intelligence in Embodied AI

RobotEQ:从被动智能到主动智能的具身AI过渡

Kuofei Fang, Xinyi Che, Haomin Ouyang, Shufan Zhang, Xuehao Wang, Qi Liu, Liyi Liu, Chenqi Zhang, Wenxi Cai, Wenyu Dai, Jinyang Wu, Fan Zhang, Haoyu Chen, Bin He, Zheng Lian

机构 * State Key Laboratory of Autonomous Intelligent Unmanned Systems, Tongji University(自主智能无人系统国家重点实验室,同济大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) CMVS, University of Oulu(奥卢大学CMVS)

专题命中 机器人数据与评测 :embodied AI(title,abstract);robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 提出RobotEQ基准,评估模型在具身场景中理解并遵守社会规范的能力,实验表明现有模型在主动智能上仍有不足,利用RAG技术可提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18765 2026-06-10 cs.RO 版本更新 79%

Goal-oriented Communication for Fast and Robust Robotic Fault Detection and Recovery

面向快速鲁棒机器人故障检测与恢复的目标导向通信

Shutong Chen, Adnan Aijaz, Yansha Deng

机构 * Department of Engineering, King’s College London(伦敦国王学院工程系) Bristol Research and Innovation Laboratory, Toshiba Europe Ltd.(托bsd欧洲有限公司布里斯托尔研究与创新实验室)

专题命中 机器人数据与评测 :robotic(title,abstract);分类 cs.RO

AI总结 提出目标导向通信框架,通过联合设计通信-计算-控制回路,利用3D场景图检测故障,并微调小语言模型结合知识蒸馏生成恢复动作,实现故障检测与恢复时间降低82.6%,任务成功率提升76%。

Comments Submit to IEEE for potential publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17080 2026-06-10 cs.RO cs.SY eess.SY 版本更新 74%

Geometric Formulation of Unified Force-Impedance Control on SE(3) for Robotic Manipulators

基于SE(3)的机器人统一力-阻抗控制的几何公式化

Joohwan Seo, Nikhil Potu Surya Prakash, Soomi Lee, Arvind Kruthiventy, Megan Teng, Jongeun Choi, Roberto Horowitz

机构 * University of California, Berkeley, USA(加州大学伯克利分校)

专题命中 机器人数据与评测 :robotic(title);分类 cs.RO

AI总结 提出一种在SE(3)流形上的阻抗控制框架,通过能量罐增强实现力跟踪与无源性,并解决非因果实现问题,继承SE(3)不变性以提高学习效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06997 2026-06-10 cs.RO cs.CV 版本更新 62%

ObjSplat: Geometry-Aware Gaussian Surfels for Active Object Reconstruction

ObjSplat: 几何感知的高斯面元用于主动物体重建

Yuetao Li, Zhizhou Jia, Yu Zhang, Qun Hao, Shaohui Zhang

机构 * School of Optics and Photonics, Beijing Institute of Technology(光学与光子学学院,北京理工大学) School of Optoelectronic Engineering, Changchun University of Science and Technology(光电工程学院,长春理工大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.CV

AI总结 提出ObjSplat框架,利用高斯面元统一表示,通过几何感知视点评估和下一最佳路径规划器,实现高效高保真的主动物体重建。

Comments Accepted to IEEE T-ASE. Code: https://github.com/Li-Yuetao/ObjSplat , Project Page: https://li-yuetao.github.io/ObjSplat-page/

详情

展开后加载摘要…

URL PDF HTML 收藏