arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 12 信号源:cs.CV, cs.GR, cs.RO

1. SLAM与定位 12 篇

2511.16144 2026-07-15 cs.CV cs.RO 版本更新 85%

LEGO-SLAM: Language-Embedded Gaussian Optimization SLAM

LEGO-SLAM:语言嵌入的高斯优化SLAM

Sibaek Lee, Seongbo Ha, Kyeongsu Kang, Joonyeol Choi, Seungjun Tak, Hyeonwoo Yu

机构 * Department of Intelligent Robotics, Sungkyunkwan University(智能机器人系,成均馆大学)

专题命中 SLAM与定位 :3DGS(summary_cn,abstract);Gaussian Splatting(abstract);分类 cs.CV、cs.RO

AI总结 研究将语言特征集成到基于3DGS的SLAM系统的问题,提出LEGO-SLAM框架,利用场景自适应自动编码器压缩语言嵌入,实现语言引导剪枝和回环检测,提升映射质量和跟踪精度,具备开放词汇能力且达15FPS。

Comments Project page :https://lab-of-ai-and-robotics.github.io/LEGO-SLAM/ Submitted to IEEE RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19474 2026-07-17 cs.CV 版本更新 84%

DINO-SLAM: DINO-informed RGB-D SLAM for Neural Implicit and Explicit Representations

DINO-SLAM:用于神经隐式和显式表示的基于DINO的RGB-D SLAM

Ziren Gong, Xiaohan Li, Fabio Tosi, Youmin Zhang, Stefano Mattoccia, Jun Wu, Matteo Poggi

机构 * University of Bologna, Italy(博洛尼亚大学) Faculty of Dentistry, The University of Hong Kong, China(香港大学牙科学院) Rawmantic AI, China(Rawmantic AI) Fudan University, Shanghai, China(复旦大学)

专题命中 SLAM与定位 :NeRF(summary_cn,abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 研究提出DINO-SLAM,通过DINO增强SLAM系统隐式与显式表示。利用场景几何编码器将DINO特征变为几何感知特征,在此基础上为NeRF和GS SLAM系统提出两种范式,相比现有方法在多个数据集上性能更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23030 2026-06-12 cs.RO cs.CV 版本更新 82%

DiskChunGS: Large-Scale 3D Gaussian SLAM Through Chunk-Based Memory Management

DiskChunGS:基于分块内存管理的大规模3D高斯SLAM

Casimir Feldmann, Maximum Wilder-Smith, Vaishakh Patil, Michael Oechsle, Michael Niemeyer, Keisuke Tateno, Marco Hutter

机构 * Robotic Systems Lab, ETH Zurich(机器人系统实验室,瑞士苏黎世联邦理工学院) Google(谷歌)

专题命中 SLAM与定位 :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV、cs.RO

AI总结 提出DiskChunGS,通过将场景划分为空间块并将非活跃区域存储于磁盘,突破GPU内存限制,实现大规模3D高斯SLAM,在多个数据集上完成全序列重建并提升视觉质量。

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 4, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10018 2026-06-11 cs.RO 版本更新 79%

LEMON-Mapping: Loop-Enhanced Large-Scale Multi-Session Point Cloud Merging and Optimization for Globally Consistent Mapping

LEMON-Mapping: 面向全局一致建图的环路增强大规模多会话点云融合与优化

Lijie Wang, Xiaoyi Zhong, Ziyi Xu, Kaixin Chai, Anke Zhao, Tianyu Zhao, Changjian Jiang, Qianhao Wang, Xieyuanli Chen, Fei Gao

机构 * Institute of CyberSystems and Control, Zhejiang University(浙江大学控制系统研究所) The Huzhou Institute, Zhejiang University(浙江大学湖州研究院) The State Key Laboratory of Industrial Control Technology, College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院国家工业控制技术重点实验室) The College of Intelligence Science and Technology, National University of Defense Technology(国防科技大学智能科学与技术学院)

专题命中 SLAM与定位 :point cloud(title,abstract);分类 cs.RO

AI总结 提出LEMON-Mapping框架,通过鲁棒环路处理、空间光束法平差和基于PGO的优化,解决多机器人建图中重叠区域发散和模糊问题,实现高精度全局一致点云融合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19345 2026-07-27 cs.HC 版本更新 67%

Navigating the Last Mile: Evaluating Head- and Cane-Mounted Cameras for Egocentric Spatial Awareness

解决最后一公里问题:评估用于自我中心空间感知的头戴式和手杖式摄像头

Apurv Varshney, Lucas Nadolskis, Tobias Höllerer, Michael Beyeler

专题命中 SLAM与定位 :NeRF(abstract);3D reconstruction(abstract)

AI总结 研究盲人行人“最后一公里”导航问题,通过混合方法,调查盲人使用者习惯并进行案例研究,用SLAM和NeRFs比较头戴与手杖式摄像头,发现核心权衡,为混合XR系统架构提供考量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18999 2026-07-10 cs.RO cs.AI cs.CV 版本更新 62%

OREN: Octree Residual Network for Real-Time Euclidean Signed Distance Mapping

OREN:八叉树残差网络用于实时欧几里得符号距离映射

Zhirui Dai, Qihao Qian, Tianxing Fan, Nikolay Atanasov

机构 * Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣地亚哥分校电子与计算机工程系)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 OREN结合八叉树插值的显式先验和神经网络回归的隐式残差,实现高效且可微的非截断SDF重建,优于现有方法的准确性和效率。

Comments Accepted to IEEE/RSJ International Conference Intelligent Robots & Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31419 2026-06-12 cs.CV cs.RO 版本更新 62%

Triangle Splatting SLAM

三角形泼溅SLAM

Nicholas Fry, Eric Dexheimer, Kirill Mazur, Paul H. J. Kelly, Andrew J. Davison

机构 * Software Performance Optimisation Group(软件性能优化组) Department of Computing(计算部门)

专题命中 SLAM与定位 :Gaussian Splatting(abstract);分类 cs.CV、cs.RO

AI总结 提出首个使用可微三角形作为3D地图表示的密集RGB-D SLAM系统,通过在线可微渲染实现跟踪与建图,并支持实时网格转换与编辑。

Comments 26 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13183 2026-08-11 cs.CV cs.MM 版本更新 57%

GeoLink: A 3D-Aware Framework Towards Better Generalization in Cross-View Geo-Localization

GeoLink:一种面向跨视角地理定位更好泛化的3D-aware框架

Hongyang Zhang, Yinhao Liu, Haitao Zhang, Zhongyi Wen, Zhenyu Kuang, Shuxian Liang, Xiansheng Hua

机构 * CUHK(SZ)(香港中文大学(深圳)) XMU(厦门大学) UESTC(电子科技大学) Foshan University(佛山大学) Tongji University(同济大学)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 本文提出GeoLink框架,通过3D感知的语义一致方法提升跨视角地理定位的泛化能力,实验表明其在多个基准测试中优于现有方法,能适应未见领域和多变天气。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16954 2026-08-06 cs.CV 版本更新 57%

TSM-Pose: Topology-Aware Learning with Semantic Mamba for Category-Level Object Pose Estimation

TSM-Pose: 基于语义Mamba的拓扑感知学习用于类别级物体姿态估计

Jinshuo Liu, Bingtao Ma, Junlin Su, Guanyuan Pan, Beining Wu, Cheng Yang, Jiaxuan Lu, Chenggang Yan, Shuai Wang

机构 * Hangzhou Dianzi University(杭州电子科技大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 本文提出TSM-Pose框架,通过拓扑提取器和语义Mamba聚合器提升类别级物体姿态估计的鲁棒性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19013 2026-07-03 cs.CV 版本更新 57%

GenHOI: Generalized Hand-Object Pose Estimation with Occlusion Awareness

GenHOI:具有遮挡意识的通用手-物体姿态估计

Hui Yang, Wei Sun, Jian Liu, Jian Xiao, Tao Xie, Hossein Rahmani, Ajmal Saeed Mian, Nicu Sebe, Gim Hee Lee

机构 * Hunan University(湖南大学) Lancaster University(兰卡斯特大学) University of Western Australia(西澳大学) University of Trento(特伦托大学) National University of Singapore(新加坡国立大学)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 本文提出GenHOI框架,通过整合层次语义知识与手部先验,提升在遮挡条件下手-物体姿态估计的泛化能力,实验表明在DexYCB和HO3Dv2基准上达到SOTA性能。

Comments European Conference on Computer Vision (ECCV), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05949 2026-06-08 cs.CV 版本更新 57%

Zero-Shot Polygon Matching with Pre-trained Models for Pose Estimation and Polygon Cloud from Challenging Stereo

基于预训练模型的零样本多边形匹配用于挑战性立体图像的姿态估计和多边形云

Chang Li, Xingtao Peng

机构 * Chang Li(李昌) Xingtao Peng(彭兴涛)

专题命中 SLAM与定位 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出首个零样本多边形匹配范式Z(PM)2,结合预训练模型和手工几何约束,通过双向金字塔匹配和局部-整体二分图优化解决视差不连续、尺度变化等问题,在姿态估计和3D表示中取得领先性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10004 2026-07-08 eess.SP 版本更新 50%

Environment-Conditioned Diffusion Meta-Learning for Data-Efficient WiFi Localization

环境感知扩散元学习用于数据高效的WiFi定位

Jun Gao, Zheng Xing, Wenliang Lin, Weibing Zhao, Xuhui Zhang, Junting Chen, Zhongliang Deng, Shuguang Cui

专题命中 SLAM与定位 :point cloud(abstract)

AI总结 本文提出EnvCoLoc框架,通过环境条件化的扩散元学习方法,解决WiFi指纹定位中跨环境泛化能力差的问题,核心贡献是引入几何感知先验和元学习初始化,提升在有限样本下的定位精度。

Comments The dataset used in this paper is publicly available at: https://drive.google.com/file/d/1GWUFExgJl3SYyIm-sUYedy9gjC_Bvq0q/view?usp=sharing

详情

展开后加载摘要…

URL PDF HTML 收藏