arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-01 至 2026-06-01 共收录 30 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 9 篇

2605.30215 2026-06-01 cs.CV 79%

Déjà View: Looping Transformers for Multi-View 3D Reconstruction

Déjà View: 用于多视图3D重建的循环Transformer

Alessandro Burzio, Tobias Fischer, Sven Elflein, Qunjie Zhou, Riccardo de Lutio, Jiawei Ren, Jiahui Huang, Shengyu Huang, Marc Pollefeys, Laura Leal-Taixé, Zan Gojcic, Haithem Turki

机构 * NVIDIA University of Modena and Reggio Emilia, AImageLab(摩德纳和雷焦艾米利亚大学,AImageLab) University of Toronto, Vector Institute(多伦多大学,向量研究所) ETH Zürich(苏黎世联邦理工学院)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 提出DéjàView模型,通过循环应用单个Transformer块进行迭代细化,以更少的参数和计算量在多个3D重建基准上达到或超越大规模前馈模型。

Comments Project Page: https://research.nvidia.com/labs/dvl/projects/dvlt

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26519 2026-06-01 cs.CV 74%

$R^3$: 3D Reconstruction via Relative Regression

$R^3$: 通过相对回归进行3D重建

Congrong Xu, Huachen Gao, Xingyu Chen, Yuliang Xiu, Jun Gao, Anpei Chen

机构 * University of Michigan(密歇根大学) Westlake University(西雅图大学) NVIDIA Research(英伟达研究)

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV

AI总结 提出一种基于相对回归的3D重建方法$R^3$,使用轻量级MLP预测置信度加权的相对约束,以支持全上下文离线重建和因果有界内存流式重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31124 2026-06-01 cs.CV 70%

QVGGT: Post-Training Quantized Visual Geometry Grounded Transformer

QVGGT: 训练后量化的视觉几何基础Transformer

Zhizhen Pan, Hesong Wang, Huan Wang

机构 * Westlake University(西湖大学) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 三维重建 :3D reconstruction(abstract);point cloud(abstract);分类 cs.CV

AI总结 针对VGGT模型参数量大、部署受限的问题,提出QVGGT量化框架,通过选择性混合精度、令牌滤波与任务感知尺度搜索,实现近无损W4A16量化,显著降低内存和加速推理。

Comments Accepted by CVPR 2026. Project page: https://ddsacu.github.io/QVGGT/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31577 2026-06-01 cs.CV 57%

SurGe: Improved Surface Geometry in Point Maps

SurGe: 改进点图中的表面几何

Karim Knaebel, Gonzalo Martin Garcia, Christian Schmidt, Ilya Fradlin, Lucas Nunes, Daan de Geus, Bastian Leibe

机构 * RWTH Aachen University(亚琛RWTH大学) Eindhoven University of Technology(埃因霍温技术大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对前馈3D重建方法中局部表面几何不准确的问题,提出点图法线度量、点梯度匹配损失和邻域注意力解码器(NAD)来改善局部表面方向预测,在多个零样本单目几何基准上取得最优平均排名。

Comments Project page at https://vision.rwth-aachen.de/surge

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31534 2026-06-01 cs.CV cs.AI 57%

Feature-Optimized Vision for Adaptive 3D Scene Reconstruction

面向自适应3D场景重建的特征优化视觉

Eric Liang

机构 * Oracle

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出一种自适应特征优化视觉前端,通过评分纹理、可重复性、独特性、预期三角化角度和空间覆盖来分配每视图特征预算,以最大化有效轨迹并降低重建RMSE。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31466 2026-06-01 cs.CV 57%

VolFill: Single-View Amodal 3D Scene Reconstruction with Volumetric Flow Matching

VolFill: 基于体素流匹配的单视图非模态3D场景重建

Tuan Duc Ngo, Chuang Gan, Evangelos Kalogerakis

机构 * UMass Amherst(马萨诸塞大学阿姆赫斯特分校) TU Crete(希腊技术大学)

专题命中 三维重建 :spatial understanding(abstract);分类 cs.CV

AI总结 提出VolFill框架,利用混合3D VAE和潜在扩散Transformer从单张RGB图像生成完整3D场景结构,在SCRREAM和NRGB-D数据集上显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31382 2026-06-01 physics.ins-det 50%

Development of a Multi-Purpose Optical TPC for Neutron-Induced Reaction Studies at SARAF

用于SARAF中子诱导反应研究的多用途光学时间投影室

R. Felkai, M. Borysova, L. Moleri, J. Pienaar, D. Vartsky, A. Breskin, I. Mor, L. Weissman, S. Bressler

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 开发一种基于CF4闪烁气体混合物的光学时间投影室(OTPC),结合快速光电探测器和高速光学读出,实现带电粒子轨迹的3D重建,以解决天体物理相关能量下中子反应截面约束不足的问题。

Comments 7 pages, 6 figures. Accepted for publication in PoS(TAUP2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30702 2026-06-01 physics.optics 50%

Mid-infrared single-photon 3D imaging

中红外单光子三维成像

Jianan Fang, Kun Huang, E Wu, Ming Yan, Heping Zeng

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 提出一种基于非线性频率上转换的单光子灵敏度和飞秒时间分辨率的中红外飞行时间成像系统,实现低光条件下的三维结构重建和反射率获取。

Journal ref Light, Science & Applications 12, 144 (2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00833 2026-06-01 q-bio.BM cs.NA math.DG math.NA math.OC 50%

Geometric shape matching for recovering protein conformations from single-particle Cryo-EM data

几何形状匹配用于从单粒子冷冻电镜数据中恢复蛋白质构象

Erik Jansson, Jonathan Krook, Klas Modin, Ozan Öktem

专题命中 三维重建 :point cloud(abstract)

AI总结 本文利用形状分析方法,通过将蛋白质骨架的点云表示变形以匹配二维断层扫描数据,从单粒子冷冻电镜数据中恢复蛋白质的三维骨架结构。

Comments 39 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 8 篇

2605.30396 2026-06-01 cs.GR cs.LG 91%

Smaller and Faster 3DGS via Post-Training Dictionary Learning

通过训练后字典学习实现更小更快的3DGS

Jiarong Gong, Jonas Unger, Ehsan Miandji

机构 * Linköping University Department of Science and technology(利乌普斯大学科学与技术学院)

专题命中 Gaussian Splatting :3DGS(title,title_cn);Gaussian Splatting(abstract);分类 cs.GR

AI总结 提出首个基于字典学习的3DGS后训练压缩框架,无需重新训练即可显著压缩模型、保持图像质量并提升实时渲染速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09632 2026-06-01 cs.CV cs.CL 90%

X-GS: An Extensible Framework for Perceiving and Thinking via 3D Gaussian Splatting

X-GS:基于3D高斯溅射的感知与思考可扩展框架

Yueen Ma, Zenglin Xu, Irwin King

机构 * The Chinese University of Hong Kong(香港中文大学) Fudan University(复旦大学) Shanghai Academy of AI for Science(上海人工智能科学研究院)

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 提出X-GS框架,包含感知器和思考器,统一多种3DGS技术实现实时在线SLAM与语义蒸馏,并支持多模态模型完成下游任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30863 2026-06-01 cs.CV cs.GR 88%

DSD-GS: Dynamic-Static Decomposition of Gaussian Splatting for Efficient and High-Fidelity Dynamic Scene Reconstruction

DSD-GS: 面向高效高保真动态场景重建的高斯泼溅动态-静态分解

Youngtae Han, Sung-hwan Han, Youngmin Yi

机构 * Department of Artificial Intelligence Engineering, Sogang University(人工智能工程系,首尔大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);novel view synthesis(abstract);分类 cs.CV、cs.GR

AI总结 提出基于前馈高斯泼溅编码器和光流模型的动态-静态分解框架,通过消除静态区域冗余计算,在渲染质量、训练/渲染速度和存储效率上达到最优。

Comments 23 pages, 9 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09364 2026-06-01 cs.CV 87%

VAD-GS: Visibility-Aware Densification for 3D Gaussian Splatting in Dynamic Urban Scenes

VAD-GS:动态城市场景中3D高斯泼溅的可见性感知致密化

Yikang Zhang, Rui Fan

机构 * Shanghai Research Institute for Intelligent Autonomous Systems, Tongji University(同济大学智能自主系统研究所) College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院) National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Xi’an Jiaotong University(西安交通大学人机混合增强智能国家实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);point cloud(abstract);分类 cs.CV

AI总结 提出VAD-GS框架,通过体素可见性推理、多样性感知视图选择和多视图立体重建,在动态城市场景中恢复缺失几何结构,提升3D高斯泼溅的重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30987 2026-06-01 cs.CV 85%

Benchmarking Single-Step Inpainting Methods for Multi-Object 3D Gaussian Splatting Scenes

多对象3D高斯泼溅场景的单步修复方法基准测试

Finn Dröge, Cecilia Curreli, Abhishek Saroha, Daniel Cremers

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 针对3D高斯泼溅场景中的对象移除与修复任务,比较了2D修复器在3D一致性上的表现,发现基于重建的修复器优于生成扩散模型,且从头初始化场景比微调现有场景效果更好,同时引入了一个带真实数据的新多对象场景。

Comments Accepted as an extended abstract to the CVEU Workshop at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18898 2026-06-01 cs.CV 83%

DeblurSplat: SfM-free 3D Gaussian Splatting with Event Camera for Robust Deblurring

DeblurSplat:基于事件相机的无SfM三维高斯泼溅鲁棒去模糊方法

Pengteng Li, Yunfan Lu, Pinhao Song, Weiyu Guo, Huizai Yao, F. Richard Yu, Hui Xiong

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) KU Leuven(卢森堡大学) Carleton University(卡尔顿大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);point cloud(abstract);分类 cs.CV

AI总结 提出首个无需运动恢复结构的去模糊三维高斯泼溅方法,利用密集立体模块和事件流实现高质量新视图合成与高效渲染。

Comments Accepted by TMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31376 2026-06-01 cs.RO cs.CV cs.GR 82%

LiftNav: Path Planning via Semantic Lifting in TSDF-Guided Gaussian Splatting

LiftNav: TSDF引导的高斯泼溅中的语义提升路径规划

Hannah Schieber, Dominik Frischmann, Victor Schaack, Angela P. Schoellig, Daniel Roth

机构 * Technical University of Munich(慕尼黑技术大学) Human-Centered Computing and Extended Reality Lab(以人为本计算与扩展现实实验室) TUM University Hospital(慕尼黑大学医院) Clinic for Orthopedics and Sports Orthopedics(骨科与运动医学诊所) Munich Institute of Robotics and Machine Intelligence (MIRMI)(慕尼黑机器人与机器智能研究所) Learning Systems and Robotics Lab(学习系统与机器人实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV、cs.GR、cs.RO

AI总结 提出LiftNav混合导航框架,结合TSDF+GS双地图、YOLO检测、TSDF三维提升和B样条轨迹优化,实现无需密集三维嵌入的灵活语义导航,并通过铰链损失碰撞惩罚提升轨迹平滑性和安全性,在Replica数据集仿真中实现100%可行性和更短轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26262 2026-06-01 cs.CV 70%

Semantic Foam: Unifying Spatial and Semantic Scene Decomposition

Semantic Foam:统一空间与语义场景分解

Amr Sharafeldin, Shrisudhan Govindarajan, Thomas Walker, Aryan Mikaeili, Daniel Rebain, Kwang Moo Yi, Andrea Tagliasacchi

机构 * Simon Fraser University(西蒙弗雷泽大学) University of Toronto(多伦多大学) Wayve Technologies(Wayve技术公司) University of British Columbia(不列颠哥伦比亚大学) University of Edinburgh(爱丁堡大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 提出Semantic Foam,通过扩展Radiant Foam表示,结合Voronoi网格的空间分解和显式语义特征场,实现高质量、一致性的语义分割。

Comments 15 pages, 10 figures, Accepted to CVPR 2026 (Highlight) , Project page: http://semanticfoam.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 7 篇

2605.31177 2026-06-01 cs.CV 79%

Vanilla ViT for Automotive Point Cloud Semantic Segmentation

用于汽车点云语义分割的普通ViT

Gilles Puy, Nermin Samet, Alexandre Boulch, Spyros Gidaris, Tuan-Hung VU, Renaud Marlet

机构 * LIGM, CNRS, Univ Gustave Eiffel, ENPC, IP Paris, France(LIGM、CNRS、Université Gustave Eiffel、ENPC、IP Paris、法国)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出VaViT,通过精心设计的标记器、轻量级解码器头和定制数据增强,使普通非分层ViT在大规模激光雷达点云语义分割中达到或超越现有最先进方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01456 2026-06-01 cs.CV cs.AI cs.LG 79%

Rethinking Multimodal Few-Shot 3D Point Cloud Segmentation: From Fused Refinement to Decoupled Arbitration

重新思考多模态少样本3D点云分割:从融合精炼到解耦仲裁

Wentao Bian, Fenglei Xu

机构 * Suzhou University of Science and Technology(苏州科技大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 针对多模态少样本3D点云分割中“融合-精炼”范式的“可塑性-稳定性困境”和CLIP的语义盲区,提出解耦专家仲裁少样本分割网络(DA-FSS),通过解耦语义与几何路径并相互正则化梯度,实现更好的泛化性能。

Comments Accepted to IJCAI-ECAI 2026 (Main Track). 9 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30784 2026-06-01 cs.CV 57%

Text-guided Feature Disentanglement for Cross-modal Gait Recognition

文本引导的跨模态步态识别特征解耦

Zhiyang Lu, Ming Cheng

机构 * Fujian Key Laboratory of Urban Intelligent Sensing and Computing, Xiamen University(福建城市智能感知与计算重点实验室,厦门大学) Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(多媒体可信感知与高效计算重点实验室,中华人民共和国教育部,厦门大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 针对LiDAR与RGB相机之间的模态差异,提出TCFDNet网络,利用文本先验引导解耦模态共享特征,通过CLIP对齐、特征解耦和稳定性增强实现跨模态步态识别,在SUSTech1K和FreeGait数据集上达到最优性能。

Comments Accept by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06161 2026-06-01 cs.CV 57%

Sinkhorn Normalization of Diffusion Kernels

扩散核的Sinkhorn归一化

Nathan Kessler, Robin Magnet, Jean Feydy

机构 * ENS Paris-Saclay(巴黎-萨克雷大学) Inria, Université Paris Cité, Inserm, HeKA(法国国家科学研究中心、巴黎-城市大学、法国国家医学研究院、HeKA)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出一种基于Sinkhorn算法的对称变体,将通用相似性矩阵归一化为类似扩散算子,继承拉普拉斯算子的理想性质,用于不规则数据(如点云、稀疏体素网格、高斯混合)的平滑处理,并保留谱信息用于形状分析与匹配。

Comments 33 pages, 25 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31106 2026-06-01 cs.LG 50%

Riemannian Diffusion Models on General Manifolds via Physics-Informed Neural Networks

基于物理信息神经网络的通用流形上的黎曼扩散模型

Gyeonghoon Ko, Juho Lee

机构 * Korea Advanced Institute of Science and Technology, Korea(韩国科学技术院)

专题命中 点云 :point cloud(abstract)

AI总结 针对黎曼流形上热核难以解析计算的问题,提出用物理信息神经网络求解流形热方程来近似热核,从而实现扩散模型的训练与采样。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30966 2026-06-01 cs.IR cs.AI cs.CL 50%

Reading Between the Citations: A Typed Claim Network for Scientific Literature

解读引用:面向科学文献的类型化主张网络

Ning Ding, Sergio J. Rodríguez Méndez, Pouya G. Omran

机构 * Australian National University(澳大利亚国立大学)

专题命中 点云 :point cloud(abstract)

AI总结 针对现有知识图谱忽略引用立场的问题,提出将文献间引用具体化为带有立场标签的类型化主张网络,并构建了包含8260条主张的实例,在检索增强、立场摘要和拓扑分析三个任务上验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30525 2026-06-01 cs.NI 50%

From Waves to Graphs: A Ray-Tracing-Inspired Neural Radio Propagation Model

从波到图:一种受射线追踪启发的神经无线电传播模型

Paul Almasan, Stefanos Bakirtzis, José Suárez-Varela, Andra Lutu

专题命中 点云 :point cloud(abstract)

AI总结 提出GRAPHWAVE,一种基于射线追踪原理的神经图驱动传播求解器,通过点云构建等效图并应用神经消息传递,实现三维环境中接收信号强度等无线电量的准确推断。

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 新视角合成 3 篇

2605.31535 2026-06-01 cs.CV cs.AI cs.LG 79%

RayDer: Scalable Self-Supervised Novel View Synthesis from Real-World Video

RayDer: 从真实世界视频中可扩展的自监督新视角合成

Ulrich Prestel, Stefan Andreas Baumann, Nick Stracke, Björn Ommer

机构 * Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心 (MCML))

专题命中 新视角合成 :novel view synthesis(title,abstract);分类 cs.CV

AI总结 提出统一前馈变压器RayDer,将相机估计、场景重建和渲染整合为单一骨干,实现自监督新视角合成的可扩展幂律缩放,在零样本开放集性能上媲美有监督方法。

Comments Project Page: https://compvis.github.io/rayder

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30469 2026-06-01 cs.SD cs.CV 74%

3DAE: Binaural Quality Assessment for Audio Novel View Synthesis with Spatial Maps and Benchmark

3DAE: 基于空间图谱和基准的音频新视角合成双耳质量评估

Jialu Xu, Yifan Zhou

机构 * University of Waterloo(滑铁卢大学)

专题命中 新视角合成 :novel view synthesis(title);分类 cs.CV

AI总结 提出一个全参考诊断框架3DAE Map,通过时频音频误差图(幅度、ILD、IPD、时间对齐、响度和高频故障)进行视觉检查,并构建模型无关基准3DAE Bench,用于评估音频新视角合成模型的双耳预测质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24700 2026-06-01 cs.CV cs.GR 62%

SRUG: Shadow-Guided Relightable Urban Scene with Generation Model

SRUG: 基于阴影引导的可重光照城市场景生成模型

Yonghao Zhao, Zexin Yin, Jian Yang, Beibei Wang, Jin Xie

机构 * College of Computer Science, Nankai University(南开大学计算机科学学院) Nankai University(南开大学) Nanjing University(南京大学) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV、cs.GR

AI总结 提出SRUG框架,利用阴影引导3D补全模型恢复不可见区域几何,结合迭代材质分解和物理光照模型,实现从稀疏输入视图生成可重光照城市场景。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 空间理解 2 篇

2605.31148 2026-06-01 cs.CV cs.AI cs.CL 57%

SpatialAct: Probing Spatial Reasoning-to-Action Capabilities of VLM Agents in 3D Scenes

SpatialAct:探测VLM智能体在3D场景中的空间推理到行动能力

Tianhui Liu, Jie Feng, Zhiheng Zheng, Shengyuan Wang, Yiming Guo, Yanxin Xi, Hangyu Fan, Yong Li, Pan Hui

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Zhongguancun Academy(中关村学院) Tsinghua University(清华大学) Helsinki University(赫尔辛基大学)

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV

AI总结 本文提出SpatialAct基准,通过多轮交互细化、单步错误检测与修复等任务,揭示当前视觉语言模型在3D场景中从空间推理到行动存在显著差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07864 2026-06-01 cs.CV 57%

Thinking in Structures: Evaluating Spatial Intelligence in Constraint-Governed Spaces

在结构中思考:评估约束空间中的空间智能

Chen Yang, Guanxin Lin, Youquan He, Peiyao Chen, Guanghe Liu, Yufan Mo, Zhouyuan Xu, Linhao Wang, Guohui Zhang, Zihang Zhang, Shenxiang Zeng, Chen Wang, Jiansheng Fan

机构 * Tsinghua University(清华大学)

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV

AI总结 提出SSI-Bench基准,通过结构约束下的空间推理任务评估视觉语言模型的空间智能,发现模型与人类存在巨大差距。

Comments ICML 2026, Project Page: https://ssi-bench.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏

6. SLAM与定位 1 篇

2605.30488 2026-06-01 cs.RO 79%

CoMo3R-SLAM: Collaborative Monocular Dense SLAM with Learned 3D Reconstruction Priors for Outdoor Multi-Agent Systems

CoMo3R-SLAM: 面向室外多智能体系统的协作式单目稠密SLAM与学习型3D重建先验

Zhihao Cao, Qi Shao, Shuhao Zhai, Feng Tian, Anh Nguyen, Hesheng Wang, Baoru Huang

机构 * ETH Zurich(苏黎世联邦理工学院) University of Liverpool(利物浦大学) Harbin Engineering University(哈尔滨工程大学) University of Ottawa(Ottawa大学) Shanghai Jiao Tong University(上海交通大学) Imperial College London(伦敦帝国理工学院)

专题命中 SLAM与定位 :3D reconstruction(title,abstract);分类 cs.RO

AI总结 提出首个协作式单目稠密RGB SLAM系统CoMo3R-SLAM,利用学习的前馈3D重建先验实现室外多智能体地图构建,无需深度传感器即可生成全局一致的度量地图。

详情

展开后加载摘要…

URL PDF HTML 收藏