arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 534 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 534 篇

2606.13990 2026-06-15 cs.RO 新提交 70%

SplatlessDF: Continuous Distance Field Mapping with Non-Splatting Gaussians

SplatlessDF: 基于非溅射高斯分布的连续距离场映射

Monisha Mushtary Uttsha, Lan Wu, Teresa Vidal-Calleja

机构 * UTS Robotics Institute, Faculty of Engineering and IT, University of Technology Sydney(悉尼科技大学工程与信息技术学院UTS机器人研究所) School of Engineering, University of Western Australia(西澳大学工程学院)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 提出SplatlessDF框架,利用各向异性高斯元素从空间角度构建连续距离场,支持距离和梯度查询,并可与2D高斯溅射结合实现统一建模,适用于机器人导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13861 2026-06-15 cs.CV 新提交 70%

Temporal Backtracking Search for Test-time Generative Video Reasoning

时间回溯搜索:测试时生成式视频推理

Sejoon Jun, Zheng Ding, Huangyuan Su, Weirui Ye, Yilun Du

机构 * Northeastern University(东北大学) Independent Researcher(独立研究者) Harvard & Kempner(哈佛大学与肯普纳研究所) MIT(麻省理工学院)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.CV

AI总结 提出时间回溯搜索(TBS),通过将搜索空间转移到时间轴,在扩散过程中定位失败点并回溯重启,显著提升视频模型在测试时的推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13488 2026-06-12 cs.CV 新提交 70%

Point-Wise Geometry-Aware Transformer for Partial-to-Full Point Cloud Registration in Computer-Assisted Surgery

面向计算机辅助手术中部分到完整点云配准的点级几何感知Transformer

Siyu Zhou, Zhongliang Jiang

机构 * The Chair for Computer Aided Medical Procedures, Technical University of Munich(慕尼黑工业大学计算机辅助医疗程序教席) The University of Hong Kong(香港大学)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.CV

AI总结 提出GAPR-Net,一种结合卷积与Transformer的粗到细框架,通过交叉注意力融合局部与全局信息,并设计变换不变的点级几何特征,在四个骨骼数据集上实现94.2%配准召回率、1.992mm RMSE。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12027 2026-06-11 cs.RO 新提交 70%

Learning Unions of Convex Sets via Invertible Latent Decomposition for Path Planning

通过可逆潜在分解学习凸集并集用于路径规划

Taerim Yoon, Dongho Kang, Kisang Park, Junha Cha, Stelian Coros, Sungjoon Choi

机构 * Korea University(高丽大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 具身导航 :manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 提出ILD框架,联合学习可逆映射和潜在空间中的显式凸多面体并集,实现路径规划,并通过可见性引导采样保持凸集连通性,在多种环境中取得更高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09294 2026-06-09 cs.CV 新提交 70%

Virtual-point-based Solutions to Handle Generalized Absolute Pose Problem

基于虚拟点的广义绝对位姿问题求解方法

Bin Li, Banglei Guan, Shunkun Liang, Yang Shang

机构 * National University of Defense Technology(国防科技大学) Hunan Institute of Advanced Technology(湖南高级技术研究所)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.CV

AI总结 针对多相机系统广义PnP问题,提出虚拟点公式化方法,将标准PnP求解器转化为广义位姿求解器,并基于Cayley、四元数和旋转矩阵参数化导出三种求解器,在精度、全局最优性和效率上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06829 2026-06-08 cs.RO 新提交 70%

Three-dimensional hydro-cluttered locomotion by an undulatory robot

三维水杂波环境中的波动机器人运动

Tianyu Wang, Matthew Fernandez, Galen Tunnicliffe, Nikolas Cornell, Justin Duong, Donoven Dortilus, Zhaochen J. Xu, Patricia Meza, Sean Lublinsky, Darsh Parikh, Jianfeng Lin, Emily Grace, Daniel I. Goldman

机构 * Institute for Robotics and Intelligent Machines, Georgia Institute of Technology(机器人与智能机器研究所,佐治亚理工学院) School of Physics, Georgia Institute of Technology(Georgia理工学院物理系) George W. Woodruff School of Mechanical Engineering, Georgia Institute of Technology(佐治亚理工学院乔治·W·伍德鲁夫机械工程学院) School of Electrical and Computer Engineering, Georgia Institute of Technology(佐治亚理工学院电气与计算机工程学院) Department of Mechanical and Industrial Engineering, Northeastern University(东北大学机械与工业工程系) Ransom Everglades School(拉森·伊弗格莱德学校)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.RO

AI总结 提出AquaMILR机器人,通过可编程体顺应性和深度调节,在三维水杂波环境中实现快速鲁棒的前进运动,并利用惯性滚动作为自发恢复机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14424 2026-07-17 cs.RO cs.AI cs.LG 新提交 69%

ConFlow: Constraints-Guided Learning with Flow Matching for Motion Generation

ConFlow:基于流匹配的约束引导学习用于运动生成

Nutan Chen, Jianxiang Feng, Marvin Alles, Botond Cseke

机构 * LS Wiiri Robot Innovation Center(LS维里机器人创新中心) Technical University of Munich(慕尼黑工业大学) Volkswagen Group(大众集团)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI、cs.LG;robot learning(comments)

AI总结 研究针对机器人运动生成中约束与数据不匹配问题,提出ConFlow框架,将约束信息纳入训练目标,用条件高斯过程解决设计规范,用不可行演示作负监督,实验表明其能降低碰撞率、提高轨迹质量,弥合训练与推理差距。

Comments RSS 2026 Workshop on Diffusion for Robot Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07737 2026-07-10 cs.RO cs.CV cs.LG 新提交 67%

SASGeo: Stability-Aware Semantic Map Localization for GNSS-Denied UAVs -- A Framework and Synthetic Proof of Concept

SASGeo:用于全球导航卫星系统受限无人机的稳定性感知语义地图定位——一个框架和合成概念验证

Natalia Trukhina, Vadim Vashkelis

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 研究针对全球导航卫星系统受限无人机的定位问题,提出SASGeo语义地图定位框架,结合多种技术,指定具体模型并进行合成概念验证。在随机检索试验中,全局语义描述符召回率58.6%,空间语义匹配变体为94.5%-95.5%。该框架能在扰动下区分位置,为后续研究提供方向。

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07370 2026-07-10 cs.RO cs.AI cs.HC cs.LG 新提交 67%

Behavior Foundations for Quadruped Robots: ABot-C0 Technical Report

四足机器人的行为基础:ABot-C0技术报告

Xufeng Zhao, Fuzhi Yang, Jianhui Chen, Li Gao, Zhang Meng, Jie Gao, Yao Zheng, Congyang Zhao, Tianxiong Lv, Menglin Yang, Minqi Gu, Yaru Zhao, Wenyu Liu, Honglin Han, Shihui Su, Zixiao Tang, Liu Liu, Mu Xu, Yang Cai, Wenbin Tang

机构 * Alibaba Group(阿里巴巴集团)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 该研究聚焦四足机器人运动控制,提出ABot-C0通用系统,构建数据金字塔生成运动片段,训练流匹配通用策略展示跟踪缩放定律,采用特定框架推动全地形遍历运动,经实验验证其能让四足机器人迈向产品级行为智能。

Comments Abot-C0 project page will be released soon

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00316 2026-07-02 eess.SP 新提交 67%

Evolving Intelligent Complex Systems via Intellicise Networks: Architecture, Technologies, and Pathways

通过智能网络演化智能复杂系统:架构、技术与路径

Ping Zhang, Rui Meng, Xiaodong Xu, Song Gao, Zixuan Huang, Yaheng Wang, Yinqiu Liu, Ruichen Zhang, Yiming Liu, Kaiwen Yu, Yaping Sun, Han Meng, Haonan Tong, Huishi Song, Qianqian Yang, Shuoyao Wang, Lexi Xu, Qinghe Du, Geng Sun, Jiawen Kang, Gang Wu, Yiqing Zhou, Haixia Zhang, Zesong Fei, Aimin Hao, Ming Li

专题命中 具身导航 :embodied AI(abstract);embodied agent(abstract)

AI总结 本文提出基于智能网络的跨域智能通信网络架构,融合信息论、系统论等理论,通过语义提取、意图理解、生成式AI等技术,实现复杂系统的自配置与自优化,并给出具身智能通信案例。

Comments 23 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18698 2026-06-18 cs.RO cs.AI cs.LG 新提交 67%

Leveraging Energy Features for Surface Classification with Deep Learning: A Comparative Analysis Across Three Independent Datasets

利用能量特征进行基于深度学习的表面分类:三个独立数据集的比较分析

Alexander Belyaev, Oleg Kushnarev

专题命中 具身导航 :robotics(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 研究评估能量特征作为表面分类的独立或辅助模态的可行性,在三个数据集上比较多种深度学习架构,发现CNN性能最优,纯能量特征准确率85-90%,与惯性特征结合可达96-99%,且能量特征可稳定提升1-2%准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07233 2026-06-08 cs.CV cs.LG cs.RO 新提交 67%

Does Appearance Help? A Systematic Study of Image-Based Re-Identification in Online 3D Multi-Pedestrian Tracking

外观有帮助吗?在线3D多行人追踪中基于图像的重识别系统研究

Eduardo Borges, Luís Garrote, Urbano J. Nunes

机构 * Institute of Systems and Robotics, Department of Electrical and Computer Engineering, University of Coimbra(系统与机器人研究所,电气与计算机工程系,科英布拉大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 系统研究轻量级投影框架下图像重识别在在线3D多目标追踪中的作用,提出级联匹配策略以在低延迟下恢复遮挡轨迹并防止身份切换。

Comments Accepted for publication at the 35th IEEE International Conference on Robot and Human Interactive Communication (RO-MAN 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06618 2026-06-08 cs.RO cs.AI cs.LG 新提交 67%

ChronoForest: Closed-Loop Multi-Tree Diffusion Planning for Efficient Bridge Search and Route Composition

ChronoForest: 用于高效桥接搜索和路线组合的闭环多树扩散规划

Jungmin Seo, Jaesik Park

机构 * Seoul National University(首尔国立大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 针对仅依赖短程离线轨迹进行长程路线规划的问题,提出ChronoForest系统,通过锚链树扩散规划器和在线多树协调器实现局部桥接搜索与全局路线重解,在OGBench和哈密顿路线组合基准上显著提升成功率和效率。

Comments 40 pages, 4 figures, 7 tables, 3 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12515 2026-08-14 cs.CV cs.RO 新提交 62%

Can Vision-Language Models Assess Proxemic Risk from Egocentric Robot Images?

视觉-语言模型能否从机器人的第一人称视角图像评估人际距离风险?

Vladyslava Rudas, Dmytro Kuzmenko

机构 * National University of Kyiv-Mohyla Academy(基辅莫希拉国立大学) University of Turin(都灵大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 该研究评估了InternVL、Qwen-VL、SmolVLM三种VLM在机器人第一人称视角图像人际距离危险分类中的表现,发现Qwen-VL经特定优化后高危险召回率更高,当前VLM在相关推理定位上仍有局限。

Comments Accepted at the EMR 2026 workshop at ECCV 2026 (non-archival)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10023 2026-08-12 cs.RO cs.CV cs.SY eess.SY 新提交 62%

Protection Levels for Vision-Based Pose Estimation

基于视觉的位姿估计的保护水平

Olivia Beyer Bruvik, Romeo Valentin, Marc R. Schlichting, Don Walker, Mykel J. Kochenderfer

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 本研究扩展了现有视觉位姿估计框架,推导了适用于航空场景的非线性PnP问题保护水平算法,分析了相关因素对其的影响并展示了权衡关系,为视觉导航的完整性认证提供支持。

Comments 11 pages, 5 figures. Accepted for publication at the 2026 AIAA DATC/IEEE 45th Digital Avionics Systems Conference (DASC). O. Beyer Bruvik and R. Valentin contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07606 2026-08-11 cs.RO cs.AI cs.HC eess.IV 新提交 62%

Enhanced Real-Time 6-DOF Extended Reality Catheter Tracking for Evaluating Potential Improvement in Efficiency, Precision, and Depth Perception for Cardiac Interventions

用于评估心脏介入效率、精度和深度感知潜在提升的增强型实时六自由度扩展现实导管跟踪技术

Mohsen Annabestani, Sandhya Sriram, Andrew Kuzemczak, S. Chiu Wong, Alexandros Sigaras, Bobak Mosadegh

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 本研究开发基于XR的实时6-DOF导管跟踪平台,经20名医学生测试,其可使心脏介入操作速度提升超5倍、导管移动距离减约5倍,还能提高精度、降低变异性,优化操作体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04732 2026-08-06 eess.SY cs.AI cs.RO cs.SY 新提交 62%

Toward Integrating Adaptive Experience Replay and Online Uncertainty Estimation in Safe Actor-Critic Optimal Control

在安全Actor-Critic最优控制中融合自适应经验回放与在线不确定性估计

Mahshad Rastegarmoghaddam, Davoud Nikkhouy, Shima Samadzadeh

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 该研究在安全Actor-Critic最优控制中提出融合自适应经验回放与在线不确定性估计的集成架构,在二维机器人导航任务的测试中,该集成配置在极端压力测试下实现零接触且全部种子到达目标,性能优于仅移除不确定性估计的配置。

Comments Code, deterministic seeds, data, figures, and protocol files are archived at https://doi.org/10.5281/zenodo.21515850 and https://github.com/SDNT8810/safe-actor-critic-aer-ue-reproducibility

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02320 2026-08-04 cs.RO cs.CV 新提交 62%

TravKAN: Fast and Interpretable Nonlinear Traversability Analysis with Kolmogorov-Arnold Networks

TravKAN:基于Kolmogorov-Arnold网络的快速可解释非线性可通行性分析

Daniel Fusaro, Simone Mosco, Wanmeng Li, Alberto Pretto

专题命中 具身导航 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出基于Kolmogorov-Arnold网络的TravKAN框架,结合LiDAR反射率手工特征,在公开数据集上性能优于传统深度模型,兼具可解释性与高效性,适用于安全关键的机器人可通行性分析。

Comments This paper has been accepted for publication at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27194 2026-07-30 cs.CV cs.RO 新提交 62%

VidMap: Exploiting Temporal Structure for Video-Based Structure-from-Motion

VidMap:利用时序结构实现基于视频的运动恢复结构

Zador Pataki, Paul-Edouard Sarlin, Marc Pollefeys

机构 * ETH Zurich(苏黎世联邦理工学院) Google(谷歌) Microsoft(微软)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 VidMap结合SLAM序列约束与SfM全局优化,利用宽基线匹配和深度先验,在多样挑战性数据集上,较最新SLAM和SfM更鲁棒准确,可实现任意长未标定视频的度量重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24983 2026-07-29 cs.LG cs.AI math.OC stat.ML 新提交 62%

Generative Distributionally Robust Optimization

生成式分布鲁棒优化

Ziwei Zhang, Jonathan Yu-Meng Li, Zhihao Jin

机构 * Telfer School of Management, University of Ottawa(渥太华大学泰尔弗管理学院) Department of Electrical and Computer Engineering, Western University(西安大略大学电气与计算机工程系)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 研究提出生成式分布鲁棒优化(GDRO)框架,接受可采样条件生成器为名义模型,通过采样器-辛科恩配对限制最坏情况法则,可直接有限样本近似和可微实现,相比名义决策降低了罕见上下文库存遗憾和SocialGAN导航碰撞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24083 2026-07-28 cs.LG cs.RO 新提交 62%

Learning Reusable Hybrid Motion Priors for Humanoid Locomotion from Motion Imitation

从运动模仿中学习可重复使用的类人运动混合先验

Valerio Belli, Valerio Modugno, Enrico Mingo Hoffman, Fabio Amadio

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.LG

AI总结 研究提出三阶段流程,将运动模仿技能转化为可重复使用的类人运动混合先验(HMP)。先训练专家策略模仿人类运动,再提炼为冻结架构,最后训练任务级策略。经模拟评估和机器人验证,HMP可重复使用,还揭示可解释码本结构,训练码本技巧能减少下游跌倒。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22166 2026-07-27 cs.RO cs.AI 新提交 62%

Learning Spatiotemporal Decision Priors for Efficient Path Planning under Partial Observability

学习时空决策先验以实现部分可观测性下的高效路径规划

Yi Liu, Hongda Zhang, Leyao Zou, Chunlei Meng, Ziqing Zhou, Yuning Chen, Zhuo Zou, Lida Xu, Zhongxue Gan, Chun Ouyang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(智能机器人与先进制造学院,复旦大学) School of Information Science and Technology, Fudan University(信息科学与技术学院,复旦大学) Department of Information Technology, Old Dominion University(信息技术系,老 Dominion 大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 研究部分可观测性下的路径规划问题,提出ImiPath框架,从示范轨迹提炼时空决策先验,经局部时空观测表示和时空注意力策略网络转换为决策先验并纳入异构规划器,提升路径质量与搜索效率,验证了框架的适应性和实际部署潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19971 2026-07-23 cs.RO cs.CV 新提交 62%

Unified Prediction and Planning via Conflict-Aware Disjoint Parameter Training

通过冲突感知不相交参数训练实现统一预测与规划

Taewon Seo, Seonae Jeon, Giwon Lee, Kuk-Jin Yoon, Daehee Park

机构 * DGIST(韩国科学技术院大邱庆北校区) KAIST(韩国科学技术院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究社交机器人在拥挤环境中统一预测与规划问题,提出基于模型合并的不相交参数训练框架DPT,通过分布式参数学习减轻技能冲突,稀疏合并提升性能,在标准基准测试中验证其在机器人导航上通用且有效。

Comments Accepted at ECCV 2026. 38 pages, 14 figures. Project page: https://dpt2026.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17994 2026-07-21 cs.CV cs.AI 新提交 62%

HAS: Highlight-guided Attention Steering for Multimodal LLM Video Summarization

HAS:用于多模态大语言模型视频摘要的高亮引导注意力转向

Rui Chu, Yingjie Lao

机构 * Tufts University(塔夫茨大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 针对视频摘要,提出HAS方法,通过全局找连续帧级高亮分布并作为注意力转向向量,让多模态大语言模型在推理时更关注高亮帧,避免丢失信息,在多种基准测试中性能出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17058 2026-07-21 cs.RO cs.CV 新提交 62%

DROID-ANCHOR: Odometry-Anchored Recurrent Metric Depth Estimation

DROID-ANCHOR:基于里程计锚定的循环度量深度估计

Yuxuan Chen, Brook Du

机构 * UC Berkeley(加州大学伯克利分校)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究针对单目系统尺度问题,提出Metric-DROID架构,通过集成里程计,利用LSTM更新算子、不确定性感知度量后端及选择性残差微调策略,实现视觉SLAM与物理现实锚定,有效解决尺度模糊等问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15621 2026-07-20 cs.RO cs.AI 新提交 62%

Think at 5 Hz, Act at 20 Hz: Asynchronous Fast-Slow Vision-Language-Action Inference for Closed-Loop Driving

以5Hz思考,20Hz行动:用于闭环驾驶的异步快慢视觉-语言-动作推理

Yun Li, Jiachen Gong, Simon Thompson, Ehsan Javanmardi, Qunli Zhang, Zifan Zeng, Shiming Liu, Peng Wang, Zixuan Guo, Manabu Tsukada

机构 * The University of Tokyo(东京大学) TIER IV, Inc.(TIER IV公司) Huawei(华为)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 研究针对大语言模型用于闭环驾驶时推理延迟与车辆控制速率冲突的问题,提出快慢架构,慢系统用冻结主干处理历史,快专家基于缓存和当前帧回归航路点,经训练在CARLA上提升路线完成率,降低误差且可零样本转移。

Comments 13 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14228 2026-07-17 cs.CV cs.AI 新提交 62%

SeeSE3: Emergence of 3D Space in Vision Features

SeeSE3:视觉特征中3D空间的出现

Caroline Chen, Sayna Ebrahimi, Fedor Kitashov, Ming-Hsuan Yang, Leonidas Guibas, Viorica Pătrăucean, Maks Ovsjanikov

机构 * Google DeepMind(谷歌DeepMind)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.CV

AI总结 研究视觉基础模型构建的表征与3D欧几里得空间内在属性的关系,提出从拓扑和几何角度评估的探测器,发现自监督视觉模型有相关潜在子空间,并基于此提出“潜在空间导航”技术用于视觉里程计和定位。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13584 2026-07-16 cs.NE cs.CV cs.RO 新提交 62%

Visual Place Recognition Using Rate-Encoded Spiking Neural Networks with Discrete STDP Learning

使用具有离散STDP学习的速率编码脉冲神经网络进行视觉场所识别

Altzi Tsanko, Oikonomou Katerina Maria, Antonios Gasteratos

机构 * Department of Production and Management Engineering, Democritus University of Thrace(生产与管理工程系,德摩克利特大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究基于STDP的SNN-VPR视觉场所识别,提出离散张量原生实现,用PyTorch和snnTorch在Nordland数据集评估。通过闭式张量管道神经元分配、查询后状态重置及速度补偿滑动窗口聚合提高召回精度,虽各机制贡献待进一步研究,但已展示推理阶段决策影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12801 2026-07-15 cs.RO cs.AI cs.SY eess.SY 新提交 62%

Autonomous Tracking and Terminal Guidance of Moving Targets for Fixed-Wing UAVs

固定翼无人机移动目标的自主跟踪与终端制导

Wei-Hao Liou, Teng-Hu Cheng

机构 * Department of Mechanical Engineering, National Yang Ming Chiao Tung University(国立阳明交通大学机械工程学系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 研究为固定翼无人机引入统一控制框架,采用三相策略,利用UKF融合视觉检测与惯性测量,结合带约束感知的NMPC及BPNG律,实现从目标检测到终端拦截的任务,仿真验证其能稳定跟踪并精确拦截,同时遵守相关约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08391 2026-07-10 cs.RO cs.LG 新提交 62%

On Exploring Input Resolution Scaling For Anytime LiDAR Object Detection

关于探索用于任意时刻激光雷达目标检测的输入分辨率缩放

Ahmet Soyyigit, Shuochao Yao, Heechul Yun

机构 * The National Defense University(国防大学) George Mason University(乔治梅森大学) The University of Kansas(堪萨斯大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.LG

AI总结 研究为处理激光雷达点云的深度神经网络实现任意时刻计算,提出新方法可多分辨率推理,引入期限感知调度器,内存高效只需单个模型,实验表明优于现有方法,部署在模拟系统可实现无碰撞导航并避免停顿。

详情

展开后加载摘要…

URL PDF HTML 收藏