arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 21 信号源:cs.CV, cs.GR, cs.RO

1. SLAM与定位 21 篇

2606.19874 2026-06-19 cs.RO cs.CV 新提交 82%

MMD-SLAM: Structure-Enhanced Multi-Meta Gaussian Distribution-Guided Visual SLAM

MMD-SLAM:结构增强的多元高斯分布引导视觉SLAM

Fan Zhu, Ziyu Chen, Peichen Liu, Yifan Zhao, Zhisong Xu, Hui Zhu, Hongxing Zhou, Sixun Liu, Chunmao Jiang

机构 * HFIPS, Chinese Academy of Sciences(中国科学院合肥物质科学研究院) University of Science and Technology of China(中国科学技术大学) Aarhus University(奥胡斯大学) University of Tokyo(东京大学) Beijing University of Chemical Technology(北京化工大学) North China Electric Power University(华北电力大学)

专题命中 SLAM与定位 :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV、cs.RO

AI总结 提出MMD-SLAM,利用亚特兰大世界假设引导多元高斯表示,通过点线融合、主导方向编码和高斯进化策略,提升视觉SLAM的跟踪精度与建图质量。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09285 2026-08-11 eess.SP cs.AI 新提交 75%

GLocFM: A Geometry-Aware Foundation Model for 3D Indoor Wireless Localization

GLocFM:面向三维室内无线定位的几何感知基础模型

Chenghong Bian, Chaozheng Wen, Hongze Chen, Jun Zhang

专题命中 SLAM与定位 :NeRF(abstract,abstract_cn);point cloud(abstract)

AI总结 该研究针对现有学习式无线定位器无法利用环境几何信息的问题,提出GLocFM模型,联合利用WiFi测量与三维点云场景几何,在两类数据集上较基线降低近50%定位误差,鲁棒性与有效性经消融实验验证。

Comments 13 pages, single column

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10925 2026-07-14 cs.RO 新提交 74%

Mapping Pamir: Multi-Session Visual-Inertial SLAM and 3D Reconstruction of an Underwater Shipwreck

绘制帕米尔:水下沉船的多会话视觉惯性SLAM与3D重建

Michalis Chatzispyrou, Luke Horgan, Hyunkil Hwang, Harish Sathishchandra, Chinmay Burgul, Monika Roznere, Alberto Quattrini Li, Philippos Mordohai, Ioannis Rekleitis

机构 * University of Delaware(特拉华大学) Stevens Institute of Technology(史蒂文斯理工学院) Binghamton University(宾汉姆顿大学) Dartmouth College(达特茅斯学院)

专题命中 SLAM与定位 :3D reconstruction(title);分类 cs.RO

AI总结 该研究利用经济相机与潜水计算机数据,基于SVIn2和COLMAP框架,提出水下环境多会话映射框架,实现巴巴多斯海岸沉船的多会话映射,首次对沉船内外进行映射,第三个会话采用双相机拓宽视野。

Comments 8 pages, 12 figures. Accepted to ICRA 2026, Vienna, Austria

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21416 2026-07-24 cs.RO cs.CV 新提交 73%

GLAM-SLAM: Real-time Gaussian Large-scale Mapping via Flow Densification and Spatial Decomposition

GLAM-SLAM:通过流致密化和空间分解实现实时高斯大规模映射

Panagiotis Mermigkas, Argyris Manetas, Petros Maragos

机构 * HERON - Hellenic Robotics Center of Excellence, Athena Research Center(希腊机器人卓越中心 - 阿西娜研究中心) Institute of Robotics, Athena Research Center(阿西娜研究中心机器人研究所) National Technical University of Athens(雅典国立技术大学)

专题命中 SLAM与定位 :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV、cs.RO

AI总结 针对现有高斯点云SLAM系统的局限,GLAM-SLAM提出实时解耦系统,用基于特征的前端跟踪,结构化网格映射,引入流致密化和场景划分策略,在多数据集上评估,性能优于同类,提升15%,且保持实时与可扩展性,代码开源。

Comments Accepted to IROS 2026. Project page: https://glamslam.github.io/ Code: https://github.com/pmermigkas/GLAM-SLAM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09146 2026-08-11 cs.CV 新提交 70%

Multi-Submap Implicit Neural SLAM with Local-to-Global Loop Closure for Large-Scale Scene Reconstruction

面向大规模场景重建的结合局部到全局回环检测的多子图隐式神经SLAM

Tianchen Deng, Chongdi Wang, Nailin Wang, Lei Zhao, Ziqi Ma, Tianjun Zhang, Zhe Liu, Danwei Wang, Hesheng Wang

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) Carnegie Mellon University(卡内基梅隆大学) School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电气与电子工程学院)

专题命中 SLAM与定位 :NeRF(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出一种带多子图架构与双层回环检测机制的神经SLAM系统,结合渐进式建图、光流跟踪、局部到全局回环及子图间在线蒸馏算法,在大规模场景重建性能上优于现有最优方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01914 2026-08-04 cs.CV 新提交 70%

CHOW-SLAM: Compact Hybrid Representation with Complementary Overlap Window Optimization for RGB-D SLAM

CHOW-SLAM:面向RGB-D SLAM的结合互补重叠窗口优化的紧凑混合表示方法

Wenxuan Ji, Jin Xiao, Xiaoguang Hu, Jiaqi Shi, Zichong Jia, Baochang Zhang

机构 * School of Automation Science and Electrical Engineering, Beihang University(北京航空航天大学自动化科学与电气工程学院)

专题命中 SLAM与定位 :NeRF(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出CHOW-SLAM框架,通过紧凑P-H混合表示与互补重叠窗口策略构建空间、时间约束,结合ORB初始化与神经渲染优化,在多数据集上优于现有最优RGB-D SLAM方法。

Comments 33 pages, 8 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08408 2026-07-10 cs.CV cs.AI 新提交 70%

Track2Map: Online Deformable SLAM with Motion-Aware Pose Optimization in Robotic Surgery

Track2Map:机器人手术中具有运动感知姿态优化的在线可变形同步定位与地图构建

Tianyi Song, Sierra Bonilla, Xinwei Ju, Evangelos Mazomenos, Danail Stoyanov, Adam Schmidt, Omid Mohareri, Sophia Bano, Francisco Vasconcelos

机构 * University College London(伦敦大学学院) Intuitive Surgical, Inc.(直观外科公司)

专题命中 SLAM与定位 :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 针对机器人手术中3D重建问题,提出Track2Map在线3D高斯点云融合流程,能联合优化相机轨迹与场景表示。引入轨迹锚定变形初始化及利用轨迹统计稳定优化,实验显示其相比其他方法在重建质量和相机轨迹上有改进。

Comments Accepted at MICCAI 2026. This is the submitted version prior to peer review. The final authenticated version will be available on SpringerLink

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19306 2026-07-22 cs.RO cs.AI cs.CV cs.SY eess.SY 新提交 62%

From Distances to Trajectories: Real-Time Signed Distance Function Mapping and Distance-Accelerated Motion Planning for UAVs

从距离到轨迹:无人机的实时带符号距离函数映射与距离加速运动规划

Jason Stanley, Zhirui Dai, Qihao Qian, Tzu-Chin Ho, Tianxing Fan, Siddharth Saha, Christopher Barngrover, Ki Myung Brian Lee, Nikolay Atanasov

机构 * UC San Diego(加州大学圣地亚哥分校) Shield AI(护盾人工智能公司)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 研究针对无人机在杂乱环境中的自主飞行,提出围绕带符号距离函数协同设计映射与规划阶段。开发OREN重建SDF,Bubble$^\star$基于距离信息规划,减少碰撞检查。集成方法在四旋翼飞行器上实时导航,提升SDF估计并快速找到长轨迹。

Comments 25 pages, 10 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09579 2026-08-11 cs.CV 新提交 57%

You Only Flow Once: Calibrated and Real-Time Radar Pose Estimation with Multi-Hypothesis Normalizing Flows

仅一次流:基于多假设归一化流的校准且实时雷达位姿估计

Jonas Leo Mueller, Sebastian Hoefler, Dario Zanca, Naga Venkata Sai Jitin Jami, Thomas Altstidl, Bjoern M. Eskofier

机构 * Friedrich-Alexander-Universität Erlangen-Nürnberg(弗里德里希-亚历山大-埃尔兰根-纽伦堡大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) LMU München(慕尼黑大学) Helmholtz Zentrum München(慕尼黑亥姆霍兹中心)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 该研究针对雷达位姿估计的歧义问题,提出MH-NFPG方法,结合时空Transformer与归一化流,实现高效实时的校准位姿估计,性能优于扩散模型。

Comments Accepted at the Winter Conference on Applications of Computer Vision (WACV) 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07074 2026-08-10 cs.RO 新提交 57%

M2-SMap: Memory-Efficient Semantic Mapping with Hierarchical Multi-Model Representation

M2-SMap:基于分层多模型表示的内存高效语义建图

QiYing Deng, ZhongLai Wang, Yuan Gao, Wei Dong

机构 * University of Electronic Science and Technology of China(电子科技大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.RO

AI总结 本文提出基于分层多模型表示的内存高效语义建图框架M2-SMap,通过分层几何分解等策略提升场景表达,在三个RGB-D序列上实现低基元数、无物体粘连的实时建图。

Comments 8 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01509 2026-08-04 cs.CV 新提交 57%

Rolling Shutter Camera Self-Calibration

卷帘快门相机自校准

Yongcong Zhang, Navid Rabbani, Bangyan Liao, Chengbo Wang, Yizhen Lao, Adrien Bartoli

机构 * CHU Clermont-Ferrand(克莱蒙费朗大学中心医院) SURGAR, Surgical Augmented Reality(外科增强现实研究组) School of Engineering, Westlake University(西湖大学工程学院) School of Design, Hunan University(湖南大学设计学院)

专题命中 SLAM与定位 :3D vision(abstract);分类 cs.CV

AI总结 本文提出了首个无需校准靶标的卷帘快门相机自校准方法,通过结合两种互补成像模型构建统一双投影模型,经仿真与真实数据实验验证了方法的准确性与有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18875 2026-07-22 cs.CV 新提交 57%

Wave2Body: Rethinking mmWave Human Pose Estimation as Radar-to-Body Token Translation

Wave2Body:将毫米波人体姿态估计重新思考为雷达到身体的令牌转换

Bo Liang, Chen Gong, Wei Gao, Chenren Xu

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) University of Pittsburgh(匹兹堡大学) Key Laboratory of High Confidence Software Technologies, Ministry of Education (PKU)(教育部高可信软件技术重点实验室(北京大学))

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 针对毫米波雷达人体姿态估计问题,提出Wave2Body框架,通过自监督毫米波令牌器等解耦学习目标,在M4Human和mmBody实验中展现出比以往方法更强的跨域泛化能力及更低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18779 2026-07-22 cs.CV 新提交 57%

CGMap: A Geospatially Aware Deep Learning Framework for Crop Gap Mapping Using UAV

CGMap:一种使用无人机进行作物间隙映射的地理空间感知深度学习框架

Karan Sharma, Rajiv Ranjan, Dinesh Kumar, Shashank Tamaskar

机构 * Plaksha University(普拉卡沙大学)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 针对印度作物发芽监测易出错的问题,提出基于深度学习的CGMap框架,利用YOLOV8架构和无人机图像,结合最小生成树技术,精确计算甘蔗发芽情况,输出地理空间发芽图,助力提高产量和资源合理分配。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15652 2026-07-20 cs.CV 新提交 57%

CSS-BA: Gate-Guided Column Space Search for Bundle Adjustment

CSS-BA:用于光束法平差的门控列空间搜索

Ayano Kaneda, Takafumi Taketomi, Shugo Yamaguchi, Shigeo Morishima

机构 * Waseda University(早稻田大学) CyberAgent, Inc.(株式会社CyberAgent)

专题命中 SLAM与定位 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对低视差和近旋转情况下传统BA法病态问题,提出门控引导的CSS-BA,通过结合CSS和几何感知门控稳定舒尔-LM更新,所有参数保留在优化中,仅限制更新方向,实验显示其优化稳定、姿态精度提高且校准有竞争力。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09985 2026-07-14 cs.CV 新提交 57%

UniPose9D: Universal Category-Agnostic Object Pose Estimation

UniPose9D:通用的类别无关物体姿态估计

Yang You, Yi Du, Cole Harrison, Leonidas Guibas

机构 * Stanford University(斯坦福大学) Amazon(亚马逊)

专题命中 SLAM与定位 :3D vision(abstract);分类 cs.CV

AI总结 研究针对物体姿态估计中现有方法泛化性不足的问题,提出UniPose9D模型,通过采样点对、利用特定特征预测NOCS坐标,引入改进算法及流匹配,构建训练集,实验证明该模型能匹配或超越专业方法,泛化能力强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02611 2026-07-07 cs.CV cs.LG 新提交 57%

Privacy-Preserving Industrial Ergonomics: mmWave-Based Automated REBA Scoring and Pose Estimation

隐私保护的工业工效学:基于毫米波的自动化REBA评分与姿态估计

Xuhan Zhang, Zhuangzhuang Dai, Luis J. Mans, Victor Chang

机构 * Dept. of Applied AI and Robotics(应用人工智能与机器人学系) Aston University(阿斯顿大学) Birmingham, United Kingdom(英国伯明翰)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 针对工作相关肌肉骨骼疾病评估难题,提出基于毫米波雷达的端到端多任务学习框架,含时空骨架重建与回归头,用多目标损失函数及过采样策略,实验验证其高效准确。

Comments 6 pages, 4 figures. To appear in the Proceedings of the 2026 International Conference on Automation and Computing (ICAC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00881 2026-07-02 cs.CV 新提交 57%

OmniView-Space: Reinforcing Spatial Reasoning via Multi-Perspective Spatial Mapping

OmniView-Space: 通过多视角空间映射增强空间推理

Xudong Li, Mengdan Zhang, Peixian Chen, Jiaxi Tan, Zihao Huang, Jingyuan Zheng, Yan Zhang, Xiawu Zheng, Xing Sun, Rongrong Ji

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(厦门大学多媒体可信感知与高效计算教育部重点实验室) Tencent Youtu Lab(腾讯优图实验室) Beijing Institute of Technology(北京理工大学)

专题命中 SLAM与定位 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出OmniView-Space框架,通过多视角空间映射、工具引导的自我中心推理和认知图蒸馏,解决多模态大模型在多步空间推理中的参考框架动态重锚问题,在单/多图像基准上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27444 2026-06-29 cs.CV 新提交 57%

SemCityLoc: Aerial 6DoF Localization Using Semantic 3D City Models

SemCityLoc: 使用语义3D城市模型的航空6自由度定位

Jingfeng Mao, Xuyang Chen, Qilin Zhang, Oussema Dhaouadi, Guangming Wang, Brian Sheil, Daniel Cremers, Yan Xia, Olaf Wysocki

机构 * Technical University of Munich(慕尼黑工业大学) University of Cambridge(剑桥大学) University of Science and Technology of China(中国科学技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) ETH Zurich(苏黎世联邦理工学院)

专题命中 SLAM与定位 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出SemCityLoc,通过语义-几何对齐将航空位姿估计转化为结构化表面配准,利用基础模型视觉先验和标准化LoD城市模型,在重复遮挡环境中提升位姿判别性,并引入首个真实基准SemCityLockeD,实现定位误差从9.89m降至2.62m。

Comments accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16881 2026-06-16 cs.RO 新提交 57%

SGM-SLAM: Scene Graph Matching for Data-Efficient Distributed SLAM

SGM-SLAM:面向数据高效的分布式SLAM的场景图匹配

Yewei Huang, Tixiao Shan, Abhinav Rajvanshi, Niluthpol Chowdhury Mithun, Yaxuan Li, Brendan Englot, Han-Pang Chiu

机构 * Dartmouth College(达特茅斯学院) SRI International(SRI国际) Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.RO

AI总结 提出一种基于场景图匹配的分布式SLAM框架,仅使用对象标签和质心进行匹配,通过多步数据交换与优化实现高效通信,在室内外环境中验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14534 2026-06-15 cs.CV 新提交 57%

A Lightweight Fiducial-Based Pipeline for 3D Hyperspectral Mapping of ex-vivo Lumpectomy Specimens

一种轻量级基于基准的离体肿块切除标本三维高光谱映射流水线

Anna Bicchi, Alberto Rota, Leonardo Passoni, Nicola Ancellotti, Andrea Peroni, Lorenzo Vinco, Dario Polli, Elena De Momi

机构 * Politecnico di Milano(米兰理工大学) Department of Electronics, Information and Bioengineering (DEIB), Politecnico di Milano(米兰理工大学电子、信息与生物工程系) Department of Physics, Politecnico di Milano(米兰理工大学物理系)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 提出一种全自动、免标定流水线,利用RGB图像和单次HSI采集生成离体肿块切除标本的三维高光谱点云,通过ArUco标记实现亚毫米级配准,支持术中切缘评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11880 2026-06-11 cs.CV 新提交 57%

SG2Loc: Sequential Visual Localization on 3D Scene Graphs

SG2Loc: 基于3D场景图的顺序视觉定位

Nicole Damblon, Olga Vysotska, Federico Tombari, Marc Pollefeys, Daniel Barath

机构 * ETH Zurich(苏黎世联邦理工学院) Google(谷歌) TU Munich(慕尼黑工业大学) Microsoft(微软)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 提出一种轻量级顺序视觉定位方法,利用紧凑的3D场景图表示环境,通过粒子滤波和语义匹配实现高效定位,显著降低存储需求。

Comments The code will be available at https://github.com/DmblnNicole/sg2loc

详情

展开后加载摘要…

URL PDF HTML 收藏