arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-06-16 至 2026-06-16 共收录 44 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 44 篇

2511.06998 2026-06-16 cs.RO 版本更新 85%

Raspi$^2$USBL: An open-source Raspberry Pi-Based Passive Inverted Ultra-Short Baseline Positioning System for Underwater Robotics

Raspi$^2$USBL:一种基于树莓派的开源被动倒置超短基线水下机器人定位系统

Jin Huang, Yingqiang Wang, Ying Chen

机构 * State Key Laboratory of Ocean Sensing, Ocean College of Zhejiang University(浙江省海洋传感重点实验室,浙江大学海洋学院) School of Oceanography, Shanghai Jiao Tong University(上海交通大学海洋学院)

专题命中 具身导航 :robotics(title,abstract);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出一种基于树莓派的低成本被动倒置超短基线定位系统,通过被动声学接收器和主动信标实现水下定位,在消声池、淡水湖和开放海域测试中达到0.1%斜距精度和0.1°方位角精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14763 2026-06-16 cs.RO cs.LG math.OC 新提交 84%

Bayesian Optimization for Learning Nonlinear MPC in Autonomous Agent Navigation

自主智能体导航中学习非线性模型预测控制的贝叶斯优化

Lorenzo Ortolani, Gabriel Voss, Gabriele Beltrami, Francesco Dorati, Tommaso Felice Banfi

机构 * Talos Robotics AI

专题命中 具身导航 :navigation(title,abstract);robotics(abstract,comments);分类 cs.RO、cs.LG

AI总结 提出一种无地图框架,结合滚动时域规划与非线性MPC,利用贝叶斯优化自动调参,在仿真和实物四足机器人上实现高效导航。

Comments Published at the IEEE ICRA 2026 Xplore Workshop (Oral), Cross-Disciplinary aspects of Exploration in Robotics, Reinforcement Learning, and Search

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15691 2026-06-16 cs.RO 新提交 83%

Can Causal Models Enhance Robot Navigation? Online Causal Adaptation for Real-Robot Navigation

因果模型能否增强机器人导航?面向真实机器人导航的在线因果自适应

Zhitao Liang, Alex Mitrevski, Emmanuel Dean, Karinne Ramirez-Amaro

机构 * Chalmers University of Technology(查尔姆斯理工大学)

专题命中 具身导航 :navigation(title,abstract);robotics(abstract);分类 cs.RO

AI总结 研究因果模型在真实机器人导航中的迁移问题,提出离线评估和在线自适应两种应用方式,实验表明因果模型在复杂场景下能显著提升导航性能。

Comments Accepted for publication at the 35th IEEE International Conference on Robot and Human Interactive Communication (RO-MAN)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16935 2026-06-16 cs.RO cs.AI cs.LG 新提交 83%

CrossMaps: Confidence-Aware Open-Vocabulary Semantic Mapping for Rover Navigation

CrossMaps: 用于漫游车导航的置信度感知开放词汇语义地图

Jan-Niklas Klein, Sona Ghahremani, Christian Medeiros Adriano, Holger Giese

机构 * Hasso Plattner Institute for Digital Engineering, Potsdam, Germany(哈索·普拉特纳数字工程研究所(德国波茨坦))

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.LG;robotics(comments)

AI总结 提出CrossMaps,一种实时置信度感知开放词汇语义地图构建流水线,通过多尺度CLIP嵌入、置信度融合和双记忆架构生成可查询语义地图,用于漫游车导航。

Comments IEEE International Conference on Robotics and Automation (ICRA) 2026: ROSE International Workshop on Robotics Software Engineering, June 01, 2026, Vienna, Austria

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00222 2026-06-16 cs.RO cs.AI cs.CV 版本更新 82%

MapDream: Task-Driven Map Learning for Vision-Language Navigation

MapDream: 面向视觉-语言导航的任务驱动地图学习

Guoxin Lian, Shuo Wang, Yucheng Wang, Yongcai Wang, Maiyue Chen, Kaihui Wang, Bo Zhang, Zhizhong Su, Deying Li, Zhaoxin Fan

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 提出MapDream框架,通过自回归鸟瞰图生成联合学习地图与动作预测,在R2R-CE和RxR-CE上达到单目最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16902 2026-06-16 cs.RO cs.AI 新提交 81%

Binary Tracking for Spatial QA and Navigation with Open Vision-Language Models

基于开放视觉语言模型的空间问答与导航的二值追踪

Dongbin Na, Chanwoo Kim, Soonbin Rho, Giyun Choi, Gangbok Lee, Dooyoung Hong

机构 * RGA Inc.(RGA公司)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 提出BinTrack,一种全开源的空间定位代理,通过二值搜索轨迹段,在SpaceLocQA基准上准确率提升22.8%,推理速度提升1.5倍,并发布多行程室外数据集GangnamLoop。

Comments 21 pages, 4 figures, 15 tables. Project page: https://ndb796.github.io/BinaryTracking ; Code and dataset: https://github.com/ndb796/BinaryTracking

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16232 2026-06-16 cs.RO 新提交 80%

PolyMerge: Compressing 3D Gaussian Splats with Polytope Coverings for Provably Safe Resource-Constrained Navigation

PolyMerge: 用多面体覆盖压缩3D高斯泼溅以实现可证明安全的资源受限导航

Jihoon Hong, Chih-Yuan Chiu, Sara Fridovich-Keil, Glen Chou

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO;robotics(journal_ref)

AI总结 提出PolyMerge,将大规模3D高斯泼溅模型转换为凸多面体覆盖,保证覆盖原模型所有障碍物,结合控制障碍函数实现实时安全路径规划,在Crazyflie无人机上验证。

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 7, pp. 8512-8519, July 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16400 2026-06-16 cs.RO 新提交 79%

SemGeoNav:A Safety-Guided Visual Navigation Approach with Semantic Reasoning and Geometric Planning

SemGeoNav:一种结合语义推理与几何规划的安全引导视觉导航方法

Yu Liu, Zongyang Chen, Yan Guo, Chao Liu, Xianfei Pan

机构 * College of Intelligence Science and Technology, National University of Defense Technology(国防科技大学智能科学学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出SemGeoNav分层视觉导航框架,融合端到端模型的高层语义推理与几何方法的可靠局部规划,实现鲁棒图像导航并显著提升避障能力,在真实机器人上优于ViNT和NoMaD。

Comments The paper has been accepted by ICGNC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15869 2026-06-16 cs.CV 新提交 79%

Metis: A Generalizable and Efficient World-Action Model for Autonomous Driving and Urban Navigation

Metis: 一种用于自动驾驶和城市导航的通用高效世界-动作模型

Jingyu Li, Zhe Liu, Dongnan Hu, Junjie Wu, Zipei Ma, Wenxiao Wu, Chao Han, Zhihui Hao, Zhikang Liu, Kun Zhan, Jiankang Deng, Xiatian Zhu, Li Zhang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) The University of Hong Kong(香港大学) Tongji University(同济大学) Li Auto Inc.(理想汽车) Huazhong University of Science and Technology(华中科技大学) Imperial College London(伦敦帝国理工学院) University of Surrey(萨里大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 提出Metis框架,通过解耦视频生成与动作预测,采用混合专家架构和不对称注意力掩码,实现高效推理与泛化,在多个导航基准上取得最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15846 2026-06-16 cs.RO 新提交 79%

FlashNav: Ultra-Fast Policy Training for Robot Navigation within 20 Seconds

FlashNav:20秒内实现超快速机器人导航策略训练

Shanze Wang, Yiwei Qian, Xinming Zhang, Jun Xue, Siwei Cheng, Xianghui Wang, Qingyuan Hu, Xiaoyu Shen, Wei Zhang

机构 * Eastern Institute of Technology, Ningbo(宁波东方理工大学) The Hong Kong Polytechnic University(香港理工大学) National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出FlashNav框架,通过GPU加速和MDP对齐实现20秒内训练可部署的导航策略,在TurtleBot2和Unitree Go2上验证成功。

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10449 2026-06-16 cs.RO 新提交 79%

GuideWalk: Learning Unified Autonomous Navigation and Locomotion for Humanoid Robots across Versatile Terrains

GuideWalk: 面向人形机器人的统一自主导航与运动学习,适用于多种地形

Haoxuan Han, Chen Chen, Linao Gong, Xin Yang, Hao Hu, Junhong Guo, Zhicheng He, Yao Su, Fenghua He

机构 * Harbin Institute of Technology(哈尔滨工业大学) Leju Robotics(乐聚机器人)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出GuideWalk框架,通过可通行性感知导航引导与地形自适应运动教师蒸馏,实现人形机器人在复杂地形上的稳定导航与运动协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04907 2026-06-16 cs.RO 版本更新 79%

WAM-Nav: Asymmetric Latent World-Action Modeling for Unified Visual Navigation

WAM-Nav:面向统一视觉导航的非对称潜在世界-动作建模

Ning Yang, Yan Huang, Kaiwen Peng, Ziheng He, Kai Wang, Cui Miao, Kailin Lyu, Guo Li, Xiaofeng Wang, Zheng Zhu, Jing Liu, Nianfeng Liu

机构 * Nanjing University(南京大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) FiveAges National University of Defense Technology(国防科技大学) Tsinghua University(清华大学) GigaAI

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出WAM-Nav,一种联合学习动作生成与潜在视觉预测的非对称扩散Transformer模型,通过共享扩散Transformer实现长时程动作与短时程视觉预测的联合扩散,并引入双流上下文条件机制和目标对齐模块,在统一策略下支持图像目标、点目标和无目标导航,在ClutterScenes和InternScenes基准上分别提升15.7%和3.3%的成功率,并在真实环境中实现85%的任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04988 2026-06-16 cs.RO cs.SY eess.SY 版本更新 79%

Intelligent Sailing Model for Open Sea Navigation

公海航行智能航行模型

Hanna Krasowski, Stefan Schärdinger, Murat Arcak, Matthias Althoff

机构 * University of California, Berkeley(加州大学伯克利分校) Technical University of Munich(慕尼黑技术大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 提出首个智能航行模型(ISM),模拟遵守海上交通规则的船舶,结合模型预测控制实现航点跟踪,在交互仿真中达到约97%的目标到达率且无碰撞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14879 2026-06-16 cs.RO cs.CV cs.LG 新提交 75%

VANDERER: Map-Free Exploration using Future-Aware and Visual-Curiosity-Guided Diffusion Policy

VANDERER: 基于未来感知与视觉好奇心引导扩散策略的无地图探索

Venkata Naren Devarakonda, Raktim Gautam Goswami, Prashanth Krishnamurthy, Farshad Khorrami

机构 * Control/Robotics Research Laboratory (CRRL), Department of Electrical and Computer Engineering, NYU Tandon School of Engineering(纽约大学坦登工程学院电气与计算机工程系控制/机器人研究实验室(CRRL)) New York University Abu Dhabi (NYUAD) Center for Artificial Intelligence and Robotics (CAIR)(纽约大学阿布扎比分校人工智能与机器人中心(CAIR))

专题命中 具身导航 :navigation(abstract);world model(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 提出VANDERER框架,利用视觉好奇心模块引导预训练扩散策略,仅依赖单目图像实现高效无地图探索,在多种模拟环境中平均探索面积比NoMaD多13.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18324 2026-06-16 cs.CV cs.AI cs.GR cs.LG stat.ML 版本更新 75%

Improved Baselines with Representation Autoencoders

改进的基于表示自动编码器的基线

Jaskirat Singh, Boyang Zheng, Zongze Wu, Richard Zhang, Eli Shechtman, Saining Xie

机构 * Adobe Research(Adobe研究院) ANU(澳大利亚国立大学) New York University(纽约大学)

专题命中 具身导航 :navigation(abstract);world model(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文研究了基于表示自动编码器(RAE)的设计选择,发现三个见解,简化并改进了RAE。首先,研究了一种通用公式,将表示定义为最后k个编码器层的总和,而不是仅最终层。其次,研究了RAE与表示对齐(REPA)的假设,发现两者具有互补的工作机制。最后,改进了RAE在无分类器指导(CFG)中的表现,通过重新参数化DiT模型输出,实现了无需训练第二个模型的指导效果。RAEv2在ImageNet-256上达到了1.06的gFID,且训练效率显著提高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16474 2026-06-16 cs.CV cs.RO 新提交 74%

MVOFormer: Flow-Semantic Transformer for Robust Monocular Visual Odometry

MVOFormer:用于鲁棒单目视觉里程计的流-语义Transformer

Jituo Li, Shunwang Sun, Jialu Zhang, Xinqi Liu, Jinyao Hu, Zhicheng Lu, Sajad Saeedi, Guodong Lu

机构 * State Key Laboratory of Fluid Power and Mechatronic Systems, Zhejiang University(浙江大学流体动力与机电系统国家重点实验室) Zhejiang Key Laboratory of Industrial Big Data and Robot Intelligent Systems(浙江省工业大数据与机器人智能系统重点实验室) School of Mechanical Engineering, Zhejiang University(浙江大学机械工程学院) Robotics Institute, Zhejiang University(浙江大学机器人研究院) School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院) Rural Health Research Institute, Charles Sturt University(查尔斯特大学农村健康研究所) University College London(伦敦大学学院)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.CV;robotics(comments)

AI总结 提出MVOFormer,一种流-语义双分支编码器与迭代多模态解码器结合的Transformer框架,通过融合密集几何运动与语义先验实现粗到细位姿优化,在零样本泛化上显著超越现有方法。

Comments 8 pages, 6 figures. Accepted for publication in IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15154 2026-06-16 cs.RO 新提交 74%

Task-Aware Environment Augmentation for Reliable Navigation via Shielded Conditional Diffusion

任务感知的环境增强:通过屏蔽条件扩散实现可靠导航

Bharawee Phoompho, Gokul Puthumanaillam, Yan Miao, Ruben Hernandez, Tim Bretl, Sayan Mitra, Melkior Ornik

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 具身导航 :navigation(title);分类 cs.RO

AI总结 针对部分可观测环境下的轨迹规划可靠性问题,提出任务感知的环境增强方法SCoDA,利用条件扩散模型学习最优视觉标记布局,通过屏蔽采样引导标记放置,提升轨迹执行可靠性和完成时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14794 2026-06-16 cs.RO 新提交 74%

Computing Smooth Geodesics under Two-Sided Curvature Bounds with Applications to Robotics and Image Analysis

计算双侧曲率约束下的光滑测地线及其在机器人和图像分析中的应用

Da Chen, Zhenjiang Li, Jean-Marie Mirebeau, Xuecheng Tai, Jinglin Zhang, Wei Zhang, Laurent D. Cohen

机构 * CEREMADE, University Paris Dauphine, University-PSL, CNRS, UMR 7534(巴黎多芬纳大学CEREMADE实验室,巴黎文理研究大学,法国国家科学研究中心,UMR 7534) Department of Radiation Oncology, Shandong Cancer Hospital and Institute, Shandong First Medical University, Shandong Academy of Medical Sciences(山东省肿瘤医院放射肿瘤科,山东第一医科大学,山东省医学科学院) Department of Mathematics, Centre Borelli, ENS Paris-Saclay, CNRS, University Paris-Saclay(巴黎萨克雷大学数学系,博雷利中心,巴黎萨克雷高等师范学校,法国国家科学研究中心) Norce(挪威研究中心) School of Control Science and Engineering, Shandong University(山东大学控制科学与工程学院)

专题命中 具身导航 :robotics(title);分类 cs.RO

AI总结 提出一种基于Hamilton-Jacobi-Bellman偏微分方程框架的曲率有界测地线模型,通过约束曲率上下界实现路径的光滑性和几何控制,并给出离散化求解方案,应用于机器人路径规划和图像曲线结构跟踪。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25006 2026-06-16 cs.RO cs.LG cs.NE 73%

Convex-Neural RRT*: Fast and Reliable Learning-Guided Sampling for High-Quality Robot Path Planning

Convex-Neural RRT*: 快速可靠的基于学习引导的高质量机器人路径规划采样

Hichem Cheriet, Badra Khellat Kihel, Samira Chouraqui, Bara J. Emran

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 提出Convex-Neural RRT*算法,通过神经网络预测高质量路径附近的凸候选区域来引导采样,在多种环境中相比神经引导变体减少30-75%计算时间,路径长度平均减少约5%,成功率超99%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15681 2026-06-16 cs.CV 新提交 70%

3D Consistency Optimization for Self-Supervised Monocular Video Depth Estimation

自监督单目视频深度估计的3D一致性优化

Yuanye Liu, Ke Zhang, Junzhe Jiang, Li Zhang, Vishal Patel, Xiahai Zhuang

机构 * Fudan University(复旦大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 具身导航 :embodied AI(abstract);navigation(abstract);分类 cs.CV

AI总结 提出一种将视频深度估计转化为多视图3D重建的框架,通过光度渲染、世界坐标对齐和多尺度时间梯度一致性约束,实现全局3D结构一致性,在自监督和零样本临床场景中达到最先进的空间精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16042 2026-06-16 cs.RO cs.AI 新提交 62%

Leveraging Deep Learning for Object and Position Recognition of Load Carriers for Autonomous Logistics Vehicles

利用深度学习实现自主物流车辆对载具的物体与位置识别

Christoph Legat, Tobias Miller, Marco Riess

机构 * Research Group on Cognitive Autonomy & Predictive Intelligence, Technical University of Applied Sciences, Augsburg, Germany(认知自主与预测智能研究组,奥格斯堡应用技术大学,德国) Grenzebach Maschinenbau GmbH, Asbach-Bäumenheim, Germany(Grenzebach Maschinenbau GmbH,德国阿斯巴赫-博伊门海姆)

专题命中 具身导航 :robotics(abstract);分类 cs.RO、cs.AI

AI总结 提出基于深度学习的框架,通过卷积神经网络从RGBD数据中识别载具上的预定义地标并计算其位姿,实现自主物流车辆对载具的检测与定位,实验验证了工业环境下的可靠性。

Comments 6 pages, 6 figures, IFAC World Congress2026, \c{opyright} 2026 the authors. This work has been accepted to IFAC for publication under a Creative Commons Licence CC-BY-NC-ND

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14773 2026-06-16 cs.CV cs.AI 新提交 62%

Double-Helix Vision (DH-V2): A Geometry-Based Visual Sampler for Bandwidth-Constrained Perception

双螺旋视觉 (DH-V2):一种基于几何的带宽受限感知视觉采样器

Jinwen Wen

机构 * Independent Researcher(独立研究者)

专题命中 具身导航 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 提出双螺旋视觉(DH),一种基于黄金比例螺旋轨迹的几何采样器,将2D图像压缩为1D信号,实现1433倍压缩比,在CPU上0.52ms完成感知,CIFAR-10上准确率提升6.03%。

Comments 5 pages, 3 figures, 5 tables. Code and benchmarks: https://github.com/JackJ-C/double-helix-vision-tool

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17997 2026-06-16 cs.LG cs.RO 版本更新 62%

Whole-Brain Connectomic Graph Model Enables Whole-Body Locomotion Control in Fruit Fly

全脑连接组图模型实现果蝇全身运动控制

Zehao Jin, Yaoye Zhu, Chen Zhang, Yanan Sui

机构 * Tsinghua University(清华大学)

专题命中 具身导航 :embodied agent(abstract);分类 cs.RO、cs.LG

AI总结 提出Fly-connectomic Graph Model,将果蝇全脑连接组作为图结构控制器,通过深度强化学习驱动仿真果蝇运动,在多种任务中表现稳定且样本效率优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16509 2026-06-16 cs.LG cs.AI 版本更新 62%

Adaptive $k$NN graph model

自适应 $k$NN 图模型

Jiaye Li, Hang Xu, Shichao Zhang

机构 * The State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室) Zhejiang University(浙江大学) The School of Computer Science and Engineering(计算机科学与工程学院) Central South University(中南大学) School of Computer Science and Engineering(计算机科学与工程学院) Guangxi Normal University(广西师范大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 提出一种基于分层可导航小世界图与预计算投票机制的自适应图模型,将邻居选择与加权的计算负担转移到训练阶段,在保持分类精度的同时实现实时推理速度。

Comments 31 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15645 2026-06-16 cs.RO 新提交 61%

TO-SoFiT: Topology Optimization of Hydraulic Soft Fish Tail Design for programmable undulating locomotion

TO-SoFiT: 用于可编程波动运动的液压软鱼尾拓扑优化设计

A Padmaprabhan, Amal Shaji, Prabhat Kumar

机构 * Indian Institute of Technology Hyderabad(印度理工学院海得拉巴分校)

专题命中 具身导航 :robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 提出一种拓扑优化方法自动设计液压软鱼尾,平衡变形效率、流固耦合、可制造性和刚度,实现可调波动幅度和多轴弯曲,优于传统矩形尾鳍。

Comments Accepted for publication at the Advances in Robotics (AIR), 2025, IIT Jodhpur

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16972 2026-06-16 cs.RO cs.SY eess.SY 新提交 57%

When Should a Robot Replan? Regret-Guided Update Scheduling in Time-Varying MDPs

机器人何时应重新规划?时变MDP中的遗憾引导更新调度

Negin Musavi, Gokul Puthumanaillam, Ruben Hernandez, William Schafer, Melkior Ornik

机构 * University of Illinois Urbana–Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 针对时变环境下机器人因预算限制无法持续重规划的问题,提出基于动态遗憾的在线更新调度规则,在仿真和实物实验中优于固定预算基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16022 2026-06-16 cs.RO 新提交 57%

$λ$-Reachability: Geometric-Horizon Safety Bellman Equations for Humanoid Safety

$λ$-可达性:面向人形机器人安全性的几何视界安全贝尔曼方程

Rui Chen, Shangtao Li, Yifan Sun, Changliu Liu

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) Mechanical Engineering, Carnegie Mellon University(卡内基梅隆大学机械工程系)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 提出$λ$-可达性方法,通过几何分布视界和随机吸收终端的随机多步估计,实现高维机器人系统的Hamilton-Jacobi安全性分析,显著提升安全边界分类和裕度估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15522 2026-06-16 cond-mat.mtrl-sci cs.RO 新提交 57%

NIMO: A Software Platform for Closed-Loop Materials Exploration with Diverse AI Algorithms

NIMO:一个集成多种AI算法的闭环材料探索软件平台

Ryo Tamura, Naruki Yoshikawa, Koji Tsuda, Shoichi Matsuda

机构 * Center for Basic Research on Materials, National Institute for Materials Science(材料基础研究所,日本国家材料科学研究所) Graduate School of Frontier Sciences, The University of Tokyo(东京大学前沿科学研究生院) Center for Green Research on Energy and Environmental Materials, National Institute for Material Science(能源与环境材料绿色研究中心,日本国家材料科学研究所)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 提出开源平台NIMO,通过模块化AI-机器人解耦、候选池架构和统一接口,集成12种AI算法,实现跨实验室的自主材料探索。

Comments 29 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15409 2026-06-16 cs.CV 新提交 57%

Segmentation-based Detection for Efficient Multi-Task Spacecraft Perception

基于分割检测的高效多任务航天器感知

Sivaperuman Muniyasamy, Surendar Devasundaram

机构 * University of Arizona(亚利桑那大学)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 针对太空视觉感知中的多任务需求,提出集成MobileNetV3编码器与U-Net风格解码器的轻量架构,通过分割掩码联合推导检测框,在SPARK 2026挑战赛中获得0.9482综合得分,排名第二。

Comments 8 pages, 2 figures, 6 tables. CVPRW AI4SPACE-SPARK 2026 Challenge Stream-1 First Place Winners. Code is available at https://github.com/sivaastro/segdet-spark

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14992 2026-06-16 cs.AR cs.LG 新提交 57%

KATANA: A Fast, Low-Power Mapping of Kalman Filters onto Edge NPUs for Real-Time Tracking

KATANA:一种将卡尔曼滤波器快速、低功耗映射到边缘NPU上用于实时跟踪的方法

Bodhisatwa Kundu, Anish Rooj, Sumit Saha, Abhradeep Sarkar, Arghadip Das, Arnab Raha, Mrinal K. Naskar

机构 * Indian Institute of Technology, Kharagpur(印度理工学院,Khargpur分校)

专题命中 具身导航 :robotics(abstract);分类 cs.LG

AI总结 针对实时跟踪系统中卡尔曼滤波器在边缘设备上的功耗和实时性约束,提出KATANA框架,通过三种代数图重写将LKF/EKF映射到商用NPU,在Intel Core Ultra系列上实现高达97.9%的动态能耗降低。

详情

展开后加载摘要…

URL PDF HTML 收藏