arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-16 至 2026-06-16 共收录 53 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 3 篇

2603.24350 2026-06-16 cs.RO cs.AI cs.LG 版本更新 82%

Evidence of an Emergent "Self" in Continual Robot Learning

持续机器人学习中涌现的“自我”证据

Adidev Jhunjhunwala, Judah Goldfeder, Hod Lipson

机构 * Creative Machines Lab, Department of Mechanical Engineering, Columbia University(创意机器实验室,机械工程系,哥伦比亚大学) Creative Machines Lab, Department of Computer Science, Columbia University(创意机器实验室,计算机科学系,哥伦比亚大学)

专题命中 机器人学习 :robot learning(title);manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 通过比较恒定任务与持续学习下机器人的认知结构,发现持续学习机器人形成显著更稳定的不变子网络,该子网络对适应性至关重要,为量化智能系统自我概念提供原则性方法。

Comments 44 pages, 24 figures, includes supplementary materials

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13197 2026-06-16 cs.RO cs.CV cs.LG 版本更新 75%

Imitating What Works: Simulation-Filtered Modular Policy Learning from Human Videos

模仿有效的方法:基于仿真过滤的人类视频模块化策略学习

Albert J. Zhai, Kuo-Hao Zeng, Jiasen Lu, Ali Farhadi, Shenlong Wang, Wei-Chiu Ma

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Allen Institute for AI(Allen人工智能研究所) University of Washington(华盛顿大学) Cornell University(康奈尔大学)

专题命中 机器人学习 :robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 提出Perceive-Simulate-Imitate框架,通过仿真过滤人类视频中的抓取-轨迹对,学习任务导向的抓取与后抓取运动策略,无需机器人数据即可实现鲁棒操作。

Comments Transactions on Machine Learning Research (TMLR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07212 2026-06-16 cs.AI cs.LG 版本更新 62%

Sample from What You See: Visuomotor Policy Learning via Diffusion Bridge with Observation-Embedded Stochastic Differential Equation

从所见中采样:基于观测嵌入随机微分方程的扩散桥视觉运动策略学习

Zhaoyang Liu, Mokai Pan, Zhongyi Wang, Kaizhen Zhu, Haotao Lu, Haipeng Zhang, Jingya Wang, Ye Shi

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 机器人学习 :robotic(abstract);分类 cs.AI、cs.LG

AI总结 提出BridgePolicy,通过扩散桥公式将观测直接集成到随机动力学中,利用语义对齐器处理异构观测,在模拟和真实任务中超越现有生成式策略。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 14 篇

2601.05248 2026-06-16 cs.RO 版本更新 85%

LaST$_{0}$: Latent Spatio-Temporal Chain-of-Thought for Robotic Vision-Language-Action Model

LaST$_{0}$:面向机器人视觉-语言-动作模型的潜在时空思维链

Zhuoyang Liu, Jiaming Liu, Hao Chen, Jiale Yu, Ziyu Guo, Chengkai Hou, Chenyang Gu, Xiangju Mi, Renrui Zhang, Kun Wu, Zhengping Che, Jian Tang, Pheng-Ann Heng, Shanghang Zhang

机构 * National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学)

专题命中 机器人操作 :robotic(title,abstract);robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 提出LaST$_0$框架,通过潜在时空思维链在隐空间进行高效推理,避免显式推理的延迟和语言瓶颈,在10个真实世界任务中平均成功率提升13%-14%。

Comments Project page: https://vla-last0.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00768 2026-06-16 cs.RO cs.HC 版本更新 83%

An Ergonomic, Customizable Soft Robotic Glove toward Personalized Hand Rehabilitation

一种符合人体工程学、可定制的软体机器人手套,用于个性化手部康复

Rui Chen, Firman Isma Serdana, Domenico Chiaradia, Xianlong Mai, Elena Losanno, Gabriele Righi, Claudia De Santis, Federica Serra, Vincent Mendez, Cristian Camardella, Daniele Leonardis, Giulio Del Popolo, Silvestro Micera, Antonio Frisoli

机构 * The Biorobotics Inst. and Dept. of Excellence in Robotics and AI, Scuola Superiore Sant’Anna, Pisa, Italy(生物机器人研究所和机器人与人工智能卓越部门,圣安娜高等学院,比萨,意大利) Institute of Mechanical Intelligence and Department of Excellence in Robotics and AI, Scuola Superiore Sant’Anna (SSSA), 56127, Pisa, Italy(机械智能研究所和机器人与人工智能卓越部门,圣安娜高等学院(SSSA),56127,比萨,意大利) CAS Key Laboratory of Mechanical Behavior and Design of Materials, Institute of Humanoid Robots, School of Engineering Sciences, University of Science and Technology of China, Hefei, China(中国科学技术大学材料机械行为与设计国家重点实验室,人形机器人研究所,工程科学学院,合肥,中国) Modular Implantable Neuroprostheses (MINE) Laboratory, Università Vita-Salute San Raffaele & Sant’Anna School of Advanced Studies, Milan, Italy(可植入神经假体(MINE)实验室,维塔-桑瑞法大学及圣安娜高级研究学院,米兰,意大利) Careggi University Hospital, 50134 Florence, Italy(Careggi大学医院,50134,佛罗伦萨,意大利) Bertarelli Fndn. Chair in Translational Neuroengineering, Neuro X Institute, École Polytechnique Fédérale de Lausanne (EPFL), Laussane, Switzerland(伯特拉里基金会转化神经工程主席,Neuro X研究所,洛桑联邦理工学院(EPFL),洛桑,瑞士)

专题命中 机器人操作 :robotic(title,abstract);manipulation(abstract);分类 cs.RO

AI总结 针对手部康复需求,提出一种基于织物的可定制软体机器人手套,采用数控热封技术制造双腔致动器,通过个性化指关节适配和凹形外表面设计提升舒适度与抓握力,实验验证其能降低前臂肌肉活动并改善脊髓损伤患者的抓握模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07063 2026-06-16 cs.HC cs.RO 版本更新 80%

Artists' Views on Robotics Involvement in Painting Productions

艺术家对机器人参与绘画创作的看法

Francesca Cocchella, Nilay Roy Choudhury, Eric Chen, Patrícia Alves-Oliveira

机构 * CONTACT Unit, Italian Institute of Technology(意大利理工学院联络单位) University of Michigan(密歇根大学)

专题命中 机器人操作 :robotics(title,comments);robotic(abstract);分类 cs.RO

AI总结 通过八位抽象艺术家与机器人合作绘画的实证研究,发现人机协作更富趣味性和反思性,提供更大自主性,并激发克服系统限制的新策略。

Comments 10 pages, 9 figures, submitted to RAM special issue: Arts and Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02773 2026-06-16 cs.RO 版本更新 79%

Bimanual High-Density EMG Control for In-Home Mobile Manipulation by Users with Quadriplegia

用于四肢瘫痪用户居家移动操作的双侧高密度肌电控制

Jehan Yang, Eleanor Hodgson, Cindy Sun, Zackory Erickson, Doug Weber

机构 * University of California, Berkeley(加州大学伯克利分校) University of Washington(华盛顿大学)

专题命中 机器人操作 :manipulation(title);navigation(abstract);分类 cs.RO

AI总结 针对颈椎脊髓损伤用户,提出双侧高密度肌电(HDEMG)前臂袖套,结合共享自主框架实现实时手势控制移动操作器,经12天居家研究验证日常任务有效性。

Comments 17 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15919 2026-06-16 cs.RO 版本更新 79%

ReMoBot: Retrieval-Based Few-Shot Imitation Learning for Mobile Manipulation with Vision Foundation Models

ReMoBot: 基于检索的少样本模仿学习用于移动操作与视觉基础模型

Yuying Zhang, Wenyan Yang, Francesco Verdoja, Ville Kyrki, Joni Pajarinen

机构 * School of Electrical Engineering, Aalto University, Espoo, Finland(艾尔沃大学电气工程学院,埃斯波,芬兰)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出ReMoBot,一种基于检索的少样本模仿学习框架,利用视觉基础模型从演示中检索信息,解决移动操作任务中的部分可观测性和数据有限问题,在真实世界任务中取得高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00836 2026-06-16 cs.RO 版本更新 77%

One-Step Model Predictive Path Integral for Manipulator Motion Planning Using Configuration Space Distance Fields

基于构型空间距离场的一步模型预测路径积分用于机械臂运动规划

Yulin Li, Tetsuro Miyazaki, Kenji Kawashima

机构 * Department of Information Physics and Computing, The University of Tokyo(东京大学信息物理与计算系)

专题命中 机器人操作 :robotics(abstract);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出将构型空间距离场与模型预测路径积分结合,利用CDF梯度统一代价函数并缩短规划时域至一步,实现高效避障,在2D环境和7自由度机械臂仿真中成功率近100%,控制频率超750Hz。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22183 2026-06-16 cs.RO cs.AI 版本更新 73%

Action with Visual Primitives

基于视觉基元的动作生成

Weilong Guo, Yuchen Wang, Renping Zhou, Yunfeng Zhang, Rui Fang, Yuyang Pang, Wenda Xu, Gao Huang

机构 * Anyverse Dynamics Tsinghua University(清华大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 提出AVP架构,通过视觉语言模型推断下一阶段目标并生成视觉基元令牌,条件化流匹配动作专家,在通用拾放任务中成功率比pi_0.5提升27.61%。

Comments 9 pages, 6 figures. Project page: https://kingdroper.github.io/AVP/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17805 2026-06-16 cs.LG cs.AI cs.GT 版本更新 62%

Ranking Abuse via Strategic Pairwise Data Perturbations

通过策略性成对数据扰动进行排名滥用

Junyi Yao, Zihao Zheng, Jiayu Long

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 研究基于最大似然估计的成对排名系统对策略性数据扰动的脆弱性,提出自适应子集选择攻击(ASSA)方法,实验表明少量扰动即可显著改变全局排名。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20668 2026-06-16 cs.RO cs.LG 版本更新 62%

DemoDiffusion: One-Shot Human Imitation using pre-trained Diffusion Policy

DemoDiffusion: 使用预训练扩散策略的一次性人类模仿

Sungjae Park, Homanga Bharadhwaj, Shubham Tulsiani

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.LG

AI总结 提出DemoDiffusion方法,通过单次人类演示和预训练扩散策略,无需任务特定训练即可使机器人执行操作任务,在8项任务中平均成功率达83.8%。

Comments 11 pages. Published at ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08706 2026-06-16 cs.RO 版本更新 61%

OmniVTLA: Vision-Tactile-Language-Action Models with Semantic-Aligned Tactile Sensing

OmniVTLA:具有语义对齐触觉感知的视觉-触觉-语言-动作模型

Zhengxue Cheng, Yiqian Zhang, Anni Tang, Keyu Wang, Wenkang Zhang, Haoyu Li, Hengdi Zhang, Li Song

机构 * Shanghai Jiao Tong University(上海交通大学) Paxini Tech(帕辛尼科技)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO;robotics(comments)

AI总结 提出OmniVTLA架构,通过双路径触觉编码器框架和语义对齐触觉ViT,结合新数据集ObjTac,显著提升机器人操作中接触密集任务的成功率和轨迹平滑度。

Comments Accepted by IEEE Robotics and Automation Letters (RA-L). ObjTac dataset: https://readerek.github.io/Objtac.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00885 2026-06-16 cs.CV 版本更新 57%

HanDyVQA: A Video QA Benchmark for Fine-Grained Hand-Object Interaction Dynamics

HanDyVQA:面向细粒度手-物交互动态的视频问答基准

Masatoshi Tateno, Gido Kato, Hirokatsu Kataoka, Yoichi Sato, Takuma Yagi

机构 * Institute of Industrial Science, The University of Tokyo(东京大学工业科学研究所) National Institute of Advanced Industrial Science and Technology (AIST)(国家先进工业科学与技术研究院) Waseda University(早稻田大学) Visual Geometry Group, University of Oxford(牛津大学视觉几何组)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 提出HanDyVQA基准,通过六类问题(11.1K QA对)和10.3K分割掩码,全面评估视频模型对手-物交互中操作与效果的细粒度时空推理能力,发现最佳模型Gemini-2.5-Pro仅73%准确率(人类97%)。

Comments CVPR 2026, Project page: https://masatate.github.io/HanDyVQA-project-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08774 2026-06-16 q-bio.BM cs.LG 版本更新 57%

Generative Molecular Design with Steerable and Granular Synthesizability Control

具有可引导和粒度合成性控制的生成式分子设计

Jeff Guo, Víctor Sabanza-Gil, Olha Semenenko, Oleksii Hrabovskyi, Mykola Protopopov, Anna Kapeliukha, Oleksandr Mosia, Sofiia Hatych, Diana Alieksieieva, Tom Nelis, Patrick Molliet, Helena Solé-Àvila, Valentas Olikauskas, Nina Aregger, Irina Morozova, Joseph Schmidt, Zlatko Jončev, Olga Tarkhanova, Petro Borysko, Jerome Waser, Bruno Correia, Jeremy Luterbacher, Philippe Schwaller

机构 * Laboratory of Artificial Chemical Intelligence (LIAC)(人工化学智能实验室) NCCR Catalysis(催化联合研究所) Laboratory of Sustainable and Catalytic Processing (LPDC)(可持续与催化加工实验室) CHEMSPACE LLC Enamine Ltd.(Enamine有限公司) Taras Shevchenko National University of Kyiv(基塔斯·谢甫琴科基辅国立大学) V. P. Kukhar Institute of Bioorganic Chemistry and Petrochemistry(V. P. Kukhar生物有机化学与石油化学研究所) Palladin Institute of Biochemistry(Palladin生物化学研究所) Laboratory of Catalysis and Organic Synthesis (LCSO)(催化与有机合成实验室) Laboratory of Protein Design and Immunoengineering (LPDI)(蛋白质设计与免疫工程实验室)

专题命中 机器人操作 :navigation(abstract);分类 cs.LG

AI总结 提出统一合成约束分子设计与超大规模虚拟筛选的生成框架,通过可引导和粒度合成性控制,生成满足多参数优化目标且具有预测合成路径的分子,在BRD4和Wee1靶点上验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04796 2026-06-16 physics.optics 版本更新 50%

Perturbative Deformation Mechanism of Metasurface

超原子耦合与缩放的空间变形机制

Tuo Li, Xin Liu, Lin Zhu, Lei Liang

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文结合变换光学与微扰理论,揭示超原子耦合与缩放本质上源于空间变形引起的微扰效应,建立了直观且通用的耦合机制物理图像,并验证了理论预测与全波模拟的一致性。

Comments v2 revised version: revised the title to better reflect the mechanism, improved figure quality, adjusted the l case order, and added two case studies in supplementary materialscorrected grammatical errors and typos, updated references and citations

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00774 2026-06-16 cs.DB 版本更新 50%

SCOPE: Cost-Efficient Model Selection for Compound AI Systems under Quality Constraints

SCOPE: 质量约束下复合AI系统的成本高效模型选择

Yiqian Huang, Shiqi Zhang, Tianyuan Jin, Xiaokui Xiao

专题命中 机器人操作 :manipulation(abstract)

AI总结 针对复合AI系统中各模块LLM选择问题,提出SCOPE算法,通过利用每查询结果估计成本和质量,构建置信界指导搜索,在满足质量阈值下最小化平均成本,理论保证质量达标和成本近似最优。

Comments Technical report for the paper accepted at KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 13 篇

2511.06998 2026-06-16 cs.RO 版本更新 85%

Raspi$^2$USBL: An open-source Raspberry Pi-Based Passive Inverted Ultra-Short Baseline Positioning System for Underwater Robotics

Raspi$^2$USBL:一种基于树莓派的开源被动倒置超短基线水下机器人定位系统

Jin Huang, Yingqiang Wang, Ying Chen

机构 * State Key Laboratory of Ocean Sensing, Ocean College of Zhejiang University(浙江省海洋传感重点实验室,浙江大学海洋学院) School of Oceanography, Shanghai Jiao Tong University(上海交通大学海洋学院)

专题命中 具身导航 :robotics(title,abstract);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种基于树莓派的低成本被动倒置超短基线定位系统,通过被动声学接收器和主动信标实现水下定位,在消声池、淡水湖和开放海域测试中达到0.1%斜距精度和0.1°方位角精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00222 2026-06-16 cs.RO cs.AI cs.CV 版本更新 82%

MapDream: Task-Driven Map Learning for Vision-Language Navigation

MapDream: 面向视觉-语言导航的任务驱动地图学习

Guoxin Lian, Shuo Wang, Yucheng Wang, Yongcai Wang, Maiyue Chen, Kaihui Wang, Bo Zhang, Zhizhong Su, Deying Li, Zhaoxin Fan

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 提出MapDream框架,通过自回归鸟瞰图生成联合学习地图与动作预测,在R2R-CE和RxR-CE上达到单目最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04907 2026-06-16 cs.RO 版本更新 79%

WAM-Nav: Asymmetric Latent World-Action Modeling for Unified Visual Navigation

WAM-Nav:面向统一视觉导航的非对称潜在世界-动作建模

Ning Yang, Yan Huang, Kaiwen Peng, Ziheng He, Kai Wang, Cui Miao, Kailin Lyu, Guo Li, Xiaofeng Wang, Zheng Zhu, Jing Liu, Nianfeng Liu

机构 * Nanjing University(南京大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) FiveAges National University of Defense Technology(国防科技大学) Tsinghua University(清华大学) GigaAI

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出WAM-Nav,一种联合学习动作生成与潜在视觉预测的非对称扩散Transformer模型,通过共享扩散Transformer实现长时程动作与短时程视觉预测的联合扩散,并引入双流上下文条件机制和目标对齐模块,在统一策略下支持图像目标、点目标和无目标导航,在ClutterScenes和InternScenes基准上分别提升15.7%和3.3%的成功率,并在真实环境中实现85%的任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04988 2026-06-16 cs.RO cs.SY eess.SY 版本更新 79%

Intelligent Sailing Model for Open Sea Navigation

公海航行智能航行模型

Hanna Krasowski, Stefan Schärdinger, Murat Arcak, Matthias Althoff

机构 * University of California, Berkeley(加州大学伯克利分校) Technical University of Munich(慕尼黑技术大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出首个智能航行模型(ISM),模拟遵守海上交通规则的船舶,结合模型预测控制实现航点跟踪,在交互仿真中达到约97%的目标到达率且无碰撞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18324 2026-06-16 cs.CV cs.AI cs.GR cs.LG stat.ML 版本更新 75%

Improved Baselines with Representation Autoencoders

改进的基于表示自动编码器的基线

Jaskirat Singh, Boyang Zheng, Zongze Wu, Richard Zhang, Eli Shechtman, Saining Xie

机构 * Adobe Research(Adobe研究院) ANU(澳大利亚国立大学) New York University(纽约大学)

专题命中 具身导航 :navigation(abstract);world model(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文研究了基于表示自动编码器(RAE)的设计选择,发现三个见解,简化并改进了RAE。首先,研究了一种通用公式,将表示定义为最后k个编码器层的总和,而不是仅最终层。其次,研究了RAE与表示对齐(REPA)的假设,发现两者具有互补的工作机制。最后,改进了RAE在无分类器指导(CFG)中的表现,通过重新参数化DiT模型输出,实现了无需训练第二个模型的指导效果。RAEv2在ImageNet-256上达到了1.06的gFID,且训练效率显著提高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17997 2026-06-16 cs.LG cs.RO 版本更新 62%

Whole-Brain Connectomic Graph Model Enables Whole-Body Locomotion Control in Fruit Fly

全脑连接组图模型实现果蝇全身运动控制

Zehao Jin, Yaoye Zhu, Chen Zhang, Yanan Sui

机构 * Tsinghua University(清华大学)

专题命中 具身导航 :embodied agent(abstract);分类 cs.RO、cs.LG

AI总结 提出Fly-connectomic Graph Model,将果蝇全脑连接组作为图结构控制器,通过深度强化学习驱动仿真果蝇运动,在多种任务中表现稳定且样本效率优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16509 2026-06-16 cs.LG cs.AI 版本更新 62%

Adaptive $k$NN graph model

自适应 $k$NN 图模型

Jiaye Li, Hang Xu, Shichao Zhang

机构 * The State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室) Zhejiang University(浙江大学) The School of Computer Science and Engineering(计算机科学与工程学院) Central South University(中南大学) School of Computer Science and Engineering(计算机科学与工程学院) Guangxi Normal University(广西师范大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 提出一种基于分层可导航小世界图与预计算投票机制的自适应图模型,将邻居选择与加权的计算负担转移到训练阶段,在保持分类精度的同时实现实时推理速度。

Comments 31 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07099 2026-06-16 cs.CV 版本更新 57%

InfoGeo: Information-Theoretic Object-Centric Learning for Cross-View Generalizable UAV Geo-Localization

InfoGeo: 面向跨视角泛化无人机地理定位的信息论目标中心学习

Hongyang Zhang, Maonan Wang, Ziyao Wang, Hongrui Yin, Man-On Pun

机构 * The University of Hong Kong(香港大学)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 提出InfoGeo框架,利用信息瓶颈理论通过目标中心结构对齐和跨视图知识约束,增强无人机跨视角地理定位在域偏移下的鲁棒性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16273 2026-06-16 cs.RO 版本更新 57%

GenZ-LIO: Generalizable LiDAR-Inertial Odometry Beyond Confined--Open Boundaries

GenZ-LIO: 超越受限与开放边界的可泛化激光雷达-惯性里程计

Daehan Lee, Hyungtae Lim, Seongjun Kim, Soonbin Rho, Changhyeon Lee, Sanghyun Park, Junwoo Hong, Eunseon Choi, Hyunyoung Jo, Soohee Han

机构 * Computational Control Engineering Laboratory (CoCEL), Department of Convergence IT Engineering and Electrical Engineering, Pohang University of Science and Technology (POSTECH), Pohang 37673, South Korea(convergence 信息技术工程与电气工程系 计算控制工程实验室,POSTECH 首尔大学(Pohang University of Science and Technology), Pohang 37673, South Korea) Laboratory for Information & Decision Systems (LIDS), Massachusetts Institute of Technology, Cambridge, MA 02139, USA(信息与决策系统实验室,麻省理工学院(Massachusetts Institute of Technology), Cambridge, MA 02139, USA)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 提出GenZ-LIO框架,通过尺度自适应体素化、混合度量状态更新和体素剪枝对应搜索,解决受限与开放空间过渡导致的鲁棒性和效率下降问题,在42个序列上保持稳定估计。

Comments 21 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21527 2026-06-16 cond-mat.mtrl-sci cs.AI 版本更新 57%

Sustainable Materials Discovery in the Era of Artificial Intelligence

人工智能时代的可持续材料发现

Sajid Mannan, Rupert J. Myers, Rohit Batra, Rocio Mercado, Lothar Wondraczek, N. M. Anoop Krishnan

机构 * Department of Civil and Environmental Engineering, Indian Institute of Technology Delhi(印度理工学院德里分校土木与环境工程系) Department of Civil and Environmental Engineering, Imperial College London(帝国理工学院伦敦分校土木与环境工程系) Department of Metallurgical and Materials Engineering, Indian Institute of Technology Madras(印度理工学院马德拉斯分校冶金与材料工程系) Department of Computer Science and Engineering, Chalmers University of Technology & University of Gothenburg(查尔姆斯理工大学与哥德堡大学计算机科学与工程系) Yardi School of Artificial Intelligence, Indian Institute of Technology Delhi(印度理工学院德里分校亚里学校人工智能系)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 本文提出ML-LCA框架,将上游机器学习材料发现与下游生命周期评估整合,通过信息提取、统一数据库、多尺度建模、制造路径预测和不确定性优化,实现性能与可持续性协同优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19499 2026-06-16 eess.SP 版本更新 50%

Geometric Performance Analysis of Doppler-Based Positioning with a Single LEO Satellite

基于单颗低轨卫星的多普勒定位几何性能分析

Qi Liu, Marc Fernandez-Temprado, Antoni Reus-Bergas, Gonzalo Seco-Granados, Jose A. Lopez-Salcedo

专题命中 具身导航 :navigation(abstract)

AI总结 本文通过理论分析和数值模拟,研究了单颗低轨卫星多普勒定位的几何特性与精度因子,揭示了跨轨方向误差大、沿轨方向误差小的固有几何限制,为单星定位可行性提供了深入见解。

Comments 15 pages, 15 figures, submitted to IEEE Internet of Things Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07300 2026-06-16 eess.SY cs.SY 版本更新 50%

Distributed Omniscient Observers for Multi-Agent Systems: Design and Applications

多智能体系统的分布式全知观测器:设计与应用

Ganghui Cao, Xunyuan Yin

专题命中 具身导航 :navigation(abstract)

AI总结 针对异构和同构线性多智能体系统,提出基于局部输入输出信息的分布式全知观测器,使每个智能体正确估计所有智能体状态,无需全局通信图知识,应用于分布式纳什均衡求解和人工蜂群社会行为模拟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16377 2026-06-16 physics.geo-ph gr-qc physics.space-ph 版本更新 50%

Frequency Differences between Clocks on the Earth and the Moon

地球与月球时钟之间的频率差异

Mingyue Zhang, Jürgen Müller, Sergei M. Kopeikin

专题命中 具身导航 :navigation(abstract)

AI总结 基于广义相对论,建立了地球-月球时钟频率比较的完整模型,分析了重力势、坐标时间比及信号传播效应对频率差异的影响,并指出需要多链路策略抑制多普勒效应。

详情

展开后加载摘要…

URL PDF HTML 收藏