arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-05-21 至 2026-05-21 共收录 74 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 2 篇

2605.19138 2026-05-21 cs.RO cs.AI cs.LG 87%

COBALT: Crowdsourcing Robot Learning via Cloud-Based Teleoperation with Smartphones

COBALT: 通过基于云的远程操作利用智能手机进行机器人学习

Ayush Agarwal, Ansh Gandhi, Jeremy A. Collins, Omar Rayyan, Aryan Sarswat, Ranjani Koushik, Masoud Moghani, Ajay Mandlekar, Animesh Garg

机构 * Georgia Institute of Technology(佐治亚理工学院) University of California, Berkeley(加州大学伯克利分校) New York University Abu Dhabi (NYUAD)(纽约大学阿布扎克分校) University of Toronto(多伦多大学) NVIDIA(英伟达)

专题命中 机器人学习 :robot learning(title,abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文提出COBALT平台,通过基于云的远程操作技术,利用智能手机等设备大规模收集高质量的机器人学习数据,提高仿真实验和现实世界中的机器人学习效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18743 2026-05-21 cs.AI 57%

WorldString: Actionable World Representation

WorldString: 可行动态世界表征

Kunqi Xu, Jitao Li, Jianglong Ye, Tianshu Tang, Isabella Liu, Sifei Liu, Xueyan Zou

机构 * CalTech(加州理工学院) UC San Diego(南加州大学) Tsinghua University - IEI Lab(清华大学-IEI实验室) NVIDIA(英伟达)

专题命中 机器人学习 :world model(abstract);分类 cs.AI

AI总结 本文提出WorldString,一种能够通过点云或RGB-D视频流直接学习现实物体状态流形的神经架构,为构建可行动态世界模型提供基础构建块。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 21 篇

2605.21258 2026-05-21 cs.RO cs.AI 87%

Learning Structural Latent Points for Efficient Visual Representations in Robotic Manipulation

为机器人操作中的高效视觉表征学习结构潜在点

Yicheng Jiang, Jiaxu Wang, Junhao He, Zesen Gan, Junhao Li, Qiang Zhang, Jingkai Sun, Jiahang Cao, Mingyuan Sun, Xiangyu Yue, Qiming Shao

机构 * The Hong Kong University of Science and Technology(香港科技大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab) X-Humanoid Robots(X-Humanoid机器人) The University of Hong Kong(香港大学) Tsinghua University(清华大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title);分类 cs.RO、cs.AI;robotics(journal_ref)

AI总结 本文提出了一种新的预训练框架,通过学习混合表示-结构潜在点,结合隐式表示的表达能力和显式表示的结构先验,以提高机器人操作中的视觉表征效率和鲁棒性。

Journal ref International Conference on Robotics and Automation 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15157 2026-05-21 cs.RO cs.LG 84%

Hand-in-the-Loop: Improving VLA Policies for Dexterous Manipulation via Seamless Hand-Arm Intervention

手在环中:通过无缝手臂干预改进VLA策略以实现灵巧操作

Zhuohang Li, Liqun Huang, Wei Xu, Zhengming Zhu, Nie Lin, Xiao Ma, Xinjun Sheng, Ruoshi Wen

机构 * State Key Laboratory of Mechanical System and Vibration, School of Mechanical Engineering, Shanghai Jiao Tong University(机械系统与振动国家重点实验室,机械工程学院,上海交通大学) Shanghai Key Laboratory of Intelligent Robotics, Meta Robotics Institute, Shanghai Jiao Tong University, Shanghai 200240, China(智能机器人上海市重点实验室,元机器人研究院,上海交通大学,上海200240,中国) The University of Tokyo(东京大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 本文提出Hand-in-the-Loop方法,通过无缝整合人类干预与自主策略执行,减少手部操作中的突兀变化,提升双臂灵巧操作的鲁棒性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21330 2026-05-21 cs.RO 83%

Learning Robust Dexterous In-Hand Manipulation from Joint Sensors with Proprioceptive Transformer

从联合传感器学习鲁棒的灵巧手部操作

Senlan Yao, Chenyu Yang, Jaehoon Kim, Aristotelis Sympetheros, Robert K. Katzschmann

机构 * Soft Robotics Laboratory, ETH Zürich, Switzerland(苏黎世联邦理工学院软机器人实验室)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文研究如何仅依靠关节传感进行手部操作,提出了一种无需外部感知的Proprioceptive Transformer方法,通过强化学习训练教师策略并将其转化为PT,实现了在腱驱动灵巧手上的连续立方体旋转,实验表明其在旋转速度和位置估计精度上优于基线方法。

Comments 8 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20894 2026-05-21 cs.RO 83%

Mobile UMI: Cross-View Diffusion Policy with Decoupled Kinematics for Mobile Manipulation

Mobile UMI: 用于移动操作的跨视角扩散策略与解耦动力学

Haoran Huang, Haonan Dong, Huixu Dong

机构 * Zhejiang University(浙江大学)

专题命中 机器人操作 :manipulation(title,abstract);navigation(abstract);分类 cs.RO

AI总结 本文提出了一种无需硬件的演示框架Mobile UMI,通过三个组件解决移动模仿学习中的两个瓶颈问题:运动污染的动作标签和推理导致的执行延迟。核心方法是通过双摄像头捕捉全局和局部上下文,结合空间锚点统一视觉-惯性框架,并利用异步递推地执行器进行在线状态匹配,从而实现解耦的动力学和基座轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20373 2026-05-21 cs.RO cs.AI cs.CV 82%

SUGAR: A Scalable Human-Video-Driven Generalizable Humanoid Loco-Manipulation Learning Framework

SUGAR: 一种可扩展的人类-视频驱动的通用人形机器人运动-操作学习框架

Tianshu Wu, Xiangqi Kong, Yue Chen, Qize Yu, Hang Ye, Jia Li, Yizhou Wang, Hao Dong

机构 * CFCS, School of Computer Science, Peking University(计算机学院,北京大学计算机科学系) School of Computer Science and Engineering, Beihang University(计算机科学与工程学院,北航)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 该研究提出SUGAR框架,通过将多样化的视频转化为可部署的人形机器人运动-操作技能,无需特定任务的奖励工程或参考动作条件,在仿真和现实硬件中实现了六种代表性任务的高性能表现,展示了可扩展性和零样本现实迁移能力。

Comments Project Page: https://tianshuwu.github.io/sugar-humanoid/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21026 2026-05-21 cs.RO 79%

Component Influence-Driven Fastener Reduction for Robotic Disassemblability-Aware Design Simplification

基于组件影响的快速件减少用于机器人拆解意识设计简化

Takuya Kiyokawa, Tomoki Ishikura, Shingo Hamada, Genichiro Matsuda, Kensuke Harada

机构 * Department of Systems Innovation, Graduate School of Engineering Science, The University of Osaka(大阪大学工学研究科系统创新部门) Manufacturing Innovation Division, Panasonic Holdings Corporation(松下电器制造创新部门)

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出了一种分析框架,通过快速件减少来提高机器人拆解意识设计简化,该框架利用CAD模型和自动生成的接触-连接-约束(CCC)图,将机器人拆解序列规划结果转化为组件影响评分,以指导设计简化。

Comments 7 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20932 2026-05-21 cs.RO 79%

WiXus: A Wheeled-Legged Robot with Wire-Driven Environmental Utilizing to Integrate Mobility and Manipulation

WiXus: 一种配备线驱动环境利用的轮腿机器人,用于整合移动与操作

Shintaro Inoue, Kento Kawaharazuka, Temma Suzuki, Sota Yuzaki, Kei Okada

机构 * Department of Mechano-Informatics, Graduate School of Information Science and Technology, The University of Tokyo(机械信息学系,信息科学和技术研究生院,东京大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出了一种新型轮腿机器人WiXus,通过利用外部环境的线驱动机制,使机器人能够实现平面移动和三维移动,并将腿部重新用于物体操作和工具使用。

Comments Accepted at ICRA2026, website - https://shin0805.github.io/wixus/, YouTube - https://youtu.be/32qhUslR0gM

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20433 2026-05-21 cs.RO 79%

Spacetime Optimal-Transport Attention for Visuo-Haptic Imitation Learning of Contact-Rich Manipulation

时空最优传输注意力用于视觉-触觉模仿学习中的富接触操作

Yue Feng, Weicheng Huang, I-Ming Chen

机构 * Robotics Research Centre, School of Mechanical and Aerospace Engineering, Nanyang Technological University, Singapore(机器人研究中心,机械与航空航天工程学院,南洋理工大学,新加坡) Wings Robotics(Wings机器人)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出了一种三模态融合框架Spacetime Optimal-Transport Attention (SO-TA),通过熵正则化的最优传输对力-姿态衍生的子查询和视觉块进行对齐,以解决富接触操作中多模态信息融合的问题,并在真实机器人任务中实现了高成功率。

Comments 8 pages, 16 figures, 3 tables. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20811 2026-05-21 cs.RO 77%

Demo-JEPA: Joint-Embedding Predictive Architecture for One-shot Cross-Embodiment Imitation

Demo-JEPA: 一种用于单次跨体态模仿的联合嵌入预测架构

Jingyang He, Guangrun Li, Jieyu Zhang, Chengkai Hou, Zhengping Che, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(信息处理国家重点实验室,计算机学院,北京大学) University of Washington(华盛顿大学) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心)

专题命中 机器人操作 :manipulation(abstract);world model(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出Demo-JEPA,一种跨体态模仿框架,通过解耦示范意图与体态特定的执行,利用共享预测表示空间将源视觉示范转换为目标兼容的未来潜在轨迹,使目标代理通过规划实现这些子目标,从而在异构体态间实现灵活的模仿。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21414 2026-05-21 cs.RO cs.CV 73%

PointACT: Vision-Language-Action Models with Multi-Scale Point-Action Interaction

PointACT: 多尺度点-动作交互的视觉-语言-动作模型

Shizhe Chen, Paul Pacaud, Cordelia Schmid

机构 * Inria(法国国家信息与自动化研究所) École normale supérieure(法国高等科学研究院) CNRS(法国国家科学研究中心) PSL Research University(巴黎综合理工研究院)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出PointACT,一种集成层次化3D点云表示的3D感知视觉-语言-动作政策,通过多尺度点-动作交互机制提升机器人在3D环境中的精细几何推理和空间定位能力。

Comments Accepted to RSS 2026; project webpage: https://cshizhe.github.io/projects/pointact.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20392 2026-05-21 cs.RO 72%

VBT-MPC: Vision-Based Tactile MPC for Contour Following

VBT-MPC:基于视觉的触觉MPC用于轮廓跟踪

Edison Velasco-Sanchez, Luis F. Recalde, Guanrui Li, Pablo Gil

机构 * AUROVA Lab, Computer Science Research Institute, University of Alicante(AUROVA实验室,计算机科学研究院,阿利坎特大学) Worcester Polytechnic Institute(沃思堡理工大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出了一种基于视觉的触觉模型预测控制(VBT-MPC)框架,用于机器人轮廓跟踪,通过眼在手配置安装的基于视觉的触觉传感器(VBTS)直接在轮廓特征空间中操作,避免了单独的姿态估计模块和复杂的力控制架构,并在仿真和实际实验中评估了在不同几何形状和材料物体上的轮廓跟踪性能。

Comments This article has been accepted for publication in IEEE Robotics and Automation Letters. This is a preprint version. This work was supported by the Interreg-VI Sudoe and European Regional Development Funds through the REMAIN Project under Grant S1/1.1/E0111

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21398 2026-05-21 cs.RO 70%

From swept contact to pose: Probe-aware registration via complementary-shape docking

从扫掠接触到姿态:通过互补形状对接实现探针感知的注册

Chen Chen, Yunwen Li, Yifan Xu, Xiangjie Yan, Chang Shu, Jianxia Hou, Shiji Song, Xiang Li

机构 * Department of Automation, Tsinghua University(清华大学自动化系) Tsingscribe Medical Ltd.(Tsingscribe医疗有限公司) D-MAVT, ETH Zürich(苏黎世联邦理工学院D-MAVT) Peking University School and Hospital of Stomatology(北京大学口腔医学院及口腔医院) Institute for Guo Qiang, Tsinghua University(清华大学国强研究院)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 本研究提出了一种无需校准的注册方法,通过将接触注册重新表述为物体与探针扫掠体积之间的互补形状对接,显式考虑探针几何形状,并利用接触和非接触证据。该方法通过3D FFT相关性进行全局到局部搜索,然后使用李代数更新和解析接触灵敏度进行连续SE(3)细化,实现了高效的探索和指标级收敛。

Comments 8 pages, 9 figures, accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03560 2026-05-21 physics.optics cond-mat.dis-nn cond-mat.mes-hall physics.app-ph 67%

Mie-tronics supermodes and symmetry breaking in nonlocal metasurfaces

Mie-tronics supermodes and symmetry breaking in nonlocal metasurfaces

Thanh Xuan Hoang, Ayan Nussupbekov, Jie Ji, Daniel Leykam, Jaime Gomez Rivas, Yuri Kivshar

专题命中 机器人操作 :manipulation(abstract,abstract_cn)

AI总结 本文研究了非局部超材料中对称破缺对Mie共振超模的影响,发现对称破缺可以增强光捕获通过强化平面非局部耦合路径,揭示了非局部超材料中新的电磁耦合通道,为多功能超材料设计提供了新思路。

Comments 12 pages, 7 figures, History and Fundamentals of Mietronics for Light Localization

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15944 2026-05-21 cs.RO cs.LG 62%

FocalPolicy: Frequency-Optimized Chunking and Locally Anchored Flow Matching for Coherent Visuomotor Policy

FocalPolicy: 频率优化的分块和局部锚定的流匹配用于连贯的视觉-运动策略

Qian He, Zhenshuo Yang, Wenqi Liang, Chunhui Hao, Nicu Sebe, Jiandong Tian

机构 * State Key Laboratory of Robotics and Intelligent Systems, Shenyang Institute of Automation, Chinese Academy of Sciences(机器人与智能系统国家重点实验室,沈阳自动化研究所,中国科学院) University of the Chinese Academy of Sciences(中国科学院大学) University of Trento(特伦多大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.LG

AI总结 本文提出FocalPolicy,一种面向视觉-运动策略的策略,通过频率优化的分块和局部锚定的流匹配,解决连续视觉-运动策略中的精度与远见之间的平衡问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19584 2026-05-21 cs.CV 57%

ShowMak3r: Compositional TV Show Reconstruction

ShowMak3r: 动态光场的动态重建

Sangmin Kim, Seunguk Do, Daeun Lee, Jaesik Park

机构 * Seoul National University(首尔国立大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 本文提出ShowMak3r,一种能够对电视节目场景进行动态重建的综合管道,通过编辑场景实现类似影视制作控制室中的剪辑效果,解决了动态光场重建中的遮挡、杂乱舞台和视角变化等挑战。

Comments Project page : https://nstar1125.github.io/showmak3r

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20515 2026-05-21 cs.LG eess.SP 57%

Online Conformal Prediction with Corrupted Feedback

在线腐蚀反馈下的符合预测

Bowen Wang, Matteo Zecchin, Osvaldo Simeone

机构 * Department of Engineering, King’s College London(伦敦国王学院工程系) Communication Systems Department, EURECOM(EURECOM通信系统部) Institute for Intelligent Networked Systems, Northeastern University London(伦敦东北大学智能网络系统研究所)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 本文研究了在存在腐蚀反馈的情况下在线符合预测的鲁棒性问题,提出两种鲁棒方案并通过实验验证了其在腐蚀反馈下的改进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19913 2026-05-21 cond-mat.other 50%

Self-Decelerating Bright Exciton-Polariton Solitons in Bound-State-in-Continuum Microcavities

自减速的明亮极子-激子孤子在束缚态-连续微腔中

Xingran Xu, Chunyu Jia

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文研究了在支持束缚态-连续的微腔系统中明亮极子-激子孤子的形成与动力学,通过驱动耗散的格雷-皮塔耶夫斯基方程与激子库的速率方程,证明BICs为稳定凝聚态免于辐射衰减提供了稳健平台,并利用拉格朗日变分法推导出描述这些明亮孤子轨迹和速度的解析表达式,发现这些BIC工程孤子具有独特的自减速现象,最终在初始条件和系统参数决定的位置停止,进一步分析了这些孤子的动力学稳定性,为非厄密系统中极子流的操控提供了有价值的见解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21174 2026-05-21 nlin.CD nlin.AO 50%

Exact expression for maximum Lyapunov exponent during transients in computationally powerful dynamical networks

计算动力学网络中暂态期间最大李雅普诺夫指数的精确表达式

Arthur S. Powanwe, Luisa H. B. Liboni, Anif N. Shikder, Alexandra N. Busch, Kalel L. Rossi, Todd Coleman, Ján Mináč, Ulrike Feudel, Roberto C. Budzinski, Lyle E. Muller

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文研究了一种具有丰富时空动态的网络,其动态特性可用于基于动态的计算,包括逻辑门、短期记忆和简单加密。通过非线性坐标变换,该网络的时间动态可以精确求解。本文推导出网络时间依赖最大李雅普诺夫指数的精确解析表达式,并证明在有用的计算暂态期间,网络表现出正的最大李雅普诺夫指数。该框架通过网络连接性和初始条件实现了暂态寿命的代数操作,为理解和控制通过暂态进行的计算提供了严格的理论基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12236 2026-05-21 eess.SY cs.SY 50%

Multi-Axis Additive Manufacturing for Customized Automotive Components

多轴增材制造用于定制化汽车部件

Uzair Aziz Muhammad, Zheng Liu

专题命中 机器人操作 :robotic(abstract)

AI总结 本文提出了一种变量曝光方法,通过将非均匀层划分为子层并调节每个子层的UV曝光时间,以减少打印层数量,提高打印效率而不牺牲几何精度,应用于汽车部件的快速原型制造。

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13121 2026-05-21 cond-mat.str-el cond-mat.mtrl-sci cond-mat.supr-con 50%

Nematic Ising superconductivity with hidden magnetism in few-layer 6R-TaS2

少层6R-TaS2中的向列伊辛超导性与隐藏磁性

Shao-Bo Liu, Congkuan Tian, Yuqiang Fang, Hongtao Rong, Lu Cao, Xinjian Wei, Hang Cui, Mantang Chen, Di Chen, Yuanjun Song, Jian Cui, Jiankun Li, Shuyue Guan, Shuang Jia, Chaoyu Chen, Wenyu He, Fuqiang Huang, Yuhang Jiang, Jinhai Mao, X. C. Xie, K. T. Law, Jian-Hao Chen

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究展示了在少层6R-TaS2中,自发旋转对称破缺、隐藏磁性和伊辛超导性之间的交织物理现象,揭示了自然范德瓦耳斯异质结中电子耦合导致的非预期新兴物理。

Comments 16 pages, 4 figures

Journal ref Nature Communications,2024,15(1):7569

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20259 2026-05-21 physics.bio-ph physics.app-ph physics.optics 50%

Morphology-Driven optimization of Double Nanohole-based Plasmonic Optical Tweezers

基于双纳米孔结构的等离子体光学镊子的形态驱动优化

Pau Molet, Mariano Barella, Edona Karakaçi, Maria Sanz Paz, Michael Mayer

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过系统模拟和形态表征对双纳米孔结构的参数进行优化,以提高光学镊子的 trapping stiffness、局部电场约束和传输变化(ΔTT),同时降低所需光功率,从而提升其在单分子生物物理中的应用性能。

Comments 27 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 12 篇

2605.20917 2026-05-21 cs.RO 83%

SubTGraph: Large-Scale Subterranean Environment Synthesis with Controllable Topological Variability for Robotic Autonomy Validation

SubTGraph: 大规模地下环境合成与可控拓扑变化用于机器人自主性验证

F. Labra Caso, A. Saradagi, S. Fredriksson, S. Nordström, A. Koval, G. Nikolakopoulos

机构 * Robotics & AI Luleå University of Technology(机器人与人工智能卢勒奥技术大学)

专题命中 具身导航 :robotic(title,abstract);robotics(abstract);分类 cs.RO

AI总结 本文提出SubTGraph框架,用于快速合成具有高变异性的多层级地下环境,通过用户指定的拓扑、维度、纹理等参数生成不同类型的地下环境,用于验证机器人自主栈各层的严格验证。

Comments 16 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20394 2026-05-21 eess.SP 78%

Starlink Beacons for Passive LEO-Aided 9D Navigation

星链信标用于被动低轨卫星辅助的9D导航

Nisanur Camuzcu, Tiep M. Hoang, Alireza Vahid

专题命中 具身导航 :navigation(title,abstract)

AI总结 本文提出了一种端到端的低轨卫星辅助混合框架,通过融合GPS、星链下行信标和惯性测量单元(IMU)在9D(3D位置、3D速度和3D姿态)PNT系统中使用扩展卡尔曼滤波器(EKF)。研究通过提取星链下行信标调频率、基准信标调频率与OFDM衍生范围观测值,并将结果整合到惯性导航中,验证了星链调频率在GPS信号退化或间歇性不可用时对9D估计的补充作用。

Comments 5 pages, 8 figures, submitted to IEEE VTC 2026 Fall

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20299 2026-05-21 cs.LG cs.AI cs.RO 75%

Mechanisms of Misgeneralization in Physical Sequence Modeling

物理序列建模中泛化错误的机制

Kento Nishi, Raphael Tang, Karun Kumar, Core Francisco Park, Hidenori Tanaka

机构 * Harvard College(哈佛大学) Harvard John A. Paulson School of Engineering and Applied Sciences(哈佛大学约翰·A·保罗森工程与应用科学学院) Comcast AI CBS-NTT Program in Physics of Intelligence, Harvard University(哈佛大学物理智能计划) Physics of Artificial Intelligence Group, NTT Research, Inc., Sunnyvale, CA, USA(人工智能物理研究组,NTT研究公司,美国加利福尼亚州山景城) Microsoft(微软)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本文研究了物理序列建模中由于局部误差传播导致的物理泛化错误,提出了一种数据偏差核来预测物理量的质量变化,并提出了基于核的干预策略。

Comments Preprint. kentonishi.com/physical-misgeneralization

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20420 2026-05-21 cond-mat.mes-hall physics.app-ph 71%

An AI-driven robotic system for two-dimensional hetero-assemblies

基于人工智能的二维异质组装机器人系统

Xiaoxi Li, Jinkun He, Haojie Liu, Xipeng Liu, Zewen Wu, Jing Li, Kai Zhao, Shan Li, Xingdan Sun, Xiaoxue Fan, Zhiren Xiong, Xingguang Wu, Xuanzhe Sha, Zhili Lin, Caixia Yang, Luosha Han, Jie Xu, Woye Pei, Kaining Yang, Jing Zhang, Xiaolong Feng, Tongyao Zhang, Zhu Liang, Kenji Watanabe, Takashi Taniguchi, Ming Tian, Neng Wan, Jing Zhang, Jianming Lu, Wenjing Hong, Zheng Vitto Han

专题命中 具身导航 :robotic(title)

AI总结 本文提出了一种基于人工智能的机器人系统,用于高效自动化制造二维范德瓦尔异质结构,通过强化学习提升性能,展示了扭曲双层石墨烯的非常规超导性。

Comments 18 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13402 2026-05-21 cs.CV cs.AI 62%

End2Reg: Learning Task-Specific Segmentation for Markerless Registration in Spine Surgery

End2Reg: 为无标记定位学习任务特定分割在脊柱手术中

Lorenzo Pettinari, Sidaty El Hadramy, Michael Wehrli, Philippe C. Cattin, Daniel Studer, Carol C. Hasler, Maria Licci

机构 * Department of Biomedical Engineering, University of Basel, Allschwil, Switzerland(巴塞尔大学生物医学工程系,瑞士Allschwil) Department of Orthopedics, University Children’s Hospital, Basel, Switzerland(巴塞尔大学儿童医院骨科部,瑞士Basel)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出End2Reg,一种端到端深度学习框架,通过联合优化分割和定位,无需分割标签和手动步骤,从而提高脊柱手术中无标记导航的精度。

Comments Early Accepted MICCAI 2026. Code and interactive visualizations: https://lorenzopettinari.github.io/end-2-reg/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21461 2026-05-21 cs.LG 57%

A Machine Learning Framework for Weighted Least Squares GNSS Positioning based on Activation Functions

一种基于激活函数的加权最小二乘GNSS定位机器学习框架

Pin-Hsun Lee, Harry Leib

机构 * Department of Electrical and Computer Engineering, McGill University(麦吉尔大学电气与计算机工程系)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 本文提出了一种基于激活函数的加权最小二乘GNSS定位机器学习框架,通过使用信号质量指标作为训练特征,利用集成学习算法识别低质量信号,并通过激活函数将机器学习预测的分数转换为适当的权重以提高定位精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21188 2026-05-21 cs.RO 57%

A Terrain-Adaptive epsilon-Constraint MPC for Uneven Terrain Kinodynamic Planning

一种适应地形的epsilon约束MPC用于不规则地形运动动力学规划

Otobong Jerome, Geesara Kalathunga, Tiago Nascimento

机构 * Laboratório de Engenharia de Sistemas e Robótica, Universidade Federal da Paraíba(系统与机器人工程实验室,帕拉伊巴联邦大学) School of Computer Science, University of Lincoln(计算机科学学院,林肯大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文提出了一种适应地形的epsilon约束MPC方法,用于解决车辆在不规则地形上同时优化路径效率和姿态稳定性的规划问题,通过动态调整epsilon界限来实时探索帕累托前沿,并通过半参数模型结合分析车辆动力学和稀疏高斯过程来捕捉车辆-地形动力学。

详情

展开后加载摘要…

URL PDF HTML 收藏