arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-04-09 至 2026-04-09 共收录 11 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 11 篇

2603.20284 2026-04-09 cs.CV cs.GR eess.IV 81%

STAC: Plug-and-Play Spatio-Temporal Aware Cache Compression for Streaming 3D Reconstruction

STAC:用于流式3D重建的时空感知缓存压缩

Runze Wang, Yuxuan Song, Youcheng Cai, Ligang Liu

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV、cs.GR

AI总结 本文提出STAC框架,通过时空感知缓存机制提升流式3D重建的内存效率和重建质量,减少内存消耗并加速推理。

Comments 10 pages, 6 figures. Accepted by CVPR 2026. This version includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06725 2026-04-09 cs.CV 79%

Enhancing MLLM Spatial Understanding via Active 3D Scene Exploration for Multi-Perspective Reasoning

通过主动3D场景探索增强MLLM空间理解以实现多视角推理

Jiahua Chen, Qihong Tang, Weinong Wang, Qi Fan

机构 * Tsinghua University(清华大学) Nanjing University(南京大学) Tencent(腾讯)

专题命中 三维重建 :spatial understanding(title);3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出一种无需训练的框架,通过显式3D重建机制提升MLLM的空间理解能力,通过主动探索生成新视角,优于专门空间模型和通用MLLM。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07279 2026-04-09 cs.CV 79%

Mem3R: Streaming 3D Reconstruction with Hybrid Memory via Test-Time Training

Mem3R: 基于混合记忆的流式3D重建

Changkun Liu, Jiezhi Yang, Zeman Li, Yuan Deng, Jiancong Guo, Luca Ballan

机构 * Google(谷歌) The Hong Kong University of Science and Technology(香港科技大学) University of Southern California(南加州大学)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 Mem3R通过分离相机跟踪与几何映射,利用隐式快权记忆和显式token状态提升长序列的时序一致性,相比CUT3R显著提升性能并减小模型规模。

Comments Project page: https://lck666666.github.io/Mem3R/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07527 2026-04-09 cs.CV cs.GR 79%

From Orbit to Ground: Generative City Photogrammetry from Extreme Off-Nadir Satellite Images

从轨道到地面:从极端俯仰角卫星图像生成城市光束摄影测量

Fei Yu, Yu Liu, Luyang Tang, Mingchao Sun, Zengye Ge, Rui Bu, Yuchao Jin, Haisen Zhao, He Sun, Yangyan Li, Mu Xu, Wenzheng Chen, Baoquan Chen

机构 * Peking University(北京大学) AMAP(高德地图) Ant Group(蚂蚁集团) Shandong University(山东大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 三维重建 :NeRF(abstract);3DGS(abstract);3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 本文提出两种设计选择,通过2.5D高度图和可微渲染技术,解决从稀疏轨道图像合成地面视图的挑战,实现大规模城市重建。

Comments Accepted by CVPR 2026 Findings. Project page: https://pku-vcl-geometry.github.io/Orbit2Ground/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07337 2026-04-09 cs.CV 77%

From Blobs to Spokes: High-Fidelity Surface Reconstruction via Oriented Gaussians

从斑块到辐条:通过定向高斯实现高保真的表面重建

Diego Gomez, Antoine Guédon, Nissim Maruani, Bingchen Gong, Maks Ovsjanikov

机构 * LIX, École Polytechnique(LIX,巴黎综合理工学院) Inria, Côte d'Azur(法国国家信息与自动化研究所,蔚蓝海岸)

专题命中 三维重建 :Gaussian Splatting(abstract);3DGS(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本文提出Gaussian Wrapping方法,通过引入可学习的定向法向量和改进的衰减公式,实现复杂场景的高精度封闭网格重建,解决了传统3DGS在表面提取中的难题。

Comments Our project page is available in http://diego1401.github.io/BlobsToSpokesWebsite/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06671 2026-04-09 eess.IV cs.CV physics.med-ph 70%

4D Vessel Reconstruction for Benchtop Thrombectomy Analysis

用于台式血栓切除分析的4D血管重建

Ethan Nguyen, Javier Carmona, Arisa Matsuzaki, Naoki Kaneko, Katsushi Arisaka

机构 * UCLA Health(加州大学洛杉矶分校健康中心) UCLA Physics and Astronomy(加州大学洛杉矶分校物理与天文学系) Chan Zuckerberg Biohub Network(陈-扎克伯格生物中心网络) Ronald Reagan UCLA Medical Center(罗纳德·里根加州大学洛杉矶分校医学中心)

专题命中 三维重建 :Gaussian Splatting(abstract);point cloud(abstract);分类 cs.CV

AI总结 本文提出了一种低成本多视角工作流,用于台式血栓切除的4D高斯点云重建,实现了时间分辨的表面运动学和相对位移及应力代理测量,用于血栓切除台式研究。

Comments 20 pages, 10 figures, 1 table, supplementary material (3 tables, 3 figures, and 11 videos). Project page: https://ethanuser.github.io/vessel4D/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07350 2026-04-09 cs.CV cs.GR cs.LG 62%

Fast Spatial Memory with Elastic Test-Time Training

快速空间记忆与弹性测试时间训练

Ziqiao Ma, Xueyang Yu, Haoyu Zhen, Yuncong Yang, Joyce Chai, Chuang Gan

机构 * MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室) University of Michigan(密歇根大学) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 本文提出弹性测试时间训练方法,用于改进长上下文3D重建中的灾难性遗忘问题,通过引入弹性权重巩固,提升模型在处理任意长序列时的稳定性和适应性。

Comments Project Page: https://fast-spatial-memory.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07010 2026-04-09 cs.CV 57%

Synthetic Dataset Generation for Partially Observed Indoor Objects

部分观测室内物体的合成数据集生成

Jelle Vermandere, Maarten Bassier, Maarten Vergauwen

机构 * KU Leuven, Department of Civil Engineering, Ghent, Belgium(鲁汶大学土木工程系,根特,比利时)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出基于Unity的虚拟扫描框架,生成包含部分扫描和完整几何的真实合成数据集,用于训练场景重建和物体补全方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06576 2026-04-09 cs.CV eess.IV 57%

LiftFormer: Lifting and Frame Theory Based Monocular Depth Estimation Using Depth and Edge Oriented Subspace Representation

LiftFormer:基于提升理论和框架理论的单目深度估计:利用深度和边缘导向的子空间表示

Shuai Li, Huibin Bai, Yanbo Gao, Chong Lv, Hui Yuan, Chuankun Li, Wei Hua, Tian Xie

机构 * School of Control Science and Engineering, Shandong University(山东大学控制科学与工程学院) Key Laboratory of Machine Intelligence and System Control, Ministry of Education(教育部机器智能与系统控制重点实验室) School of Software, Shandong University(山东大学软件学院) Shandong University-WeiHai Research Institute of Industrial Technology(山东大学威海工业技术研究院) State Key Laboratory of Dynamic Testing Technology(动态测试技术国家重点实验室) School of Information and Communication Engineering, North University of China(中北大学信息与通信工程学院) Research Institute of Interdisciplinary Innovation, Zhejiang Lab(之江实验室跨学科创新研究院)

专题命中 三维重建 :3D vision(abstract);分类 cs.CV

AI总结 本文提出LiftFormer,通过构建连接图像颜色特征与深度值的中间子空间及增强边缘深度预测的子空间,解决单目深度估计的高 ill-posed 问题,实现从颜色值到几何深度值的学习转换。

Comments Accepted by IEEE Transactions on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27105 2026-04-09 cs.CV 57%

UniDAC: Universal Metric Depth Estimation for Any Camera

UniDAC:面向任何相机的通用度量深度估计

Girish Chandar Ganesan, Yuliang Guo, Liu Ren, Xiaoming Liu

机构 * Michigan State University(密歇根州立大学) Bosch Research North America & Bosch Center for AI (BCAI)(博世北美研究院与博世人工智能中心) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 三维重建 :spatial understanding(abstract);分类 cs.CV

AI总结 本文提出UniDAC框架,通过分离度量深度估计为相对深度预测和空间变化尺度估计,实现跨不同相机类型的通用鲁棒性,采用轻量级Depth-Guided Scale Estimation模块和RoPE-ϕ位置嵌入提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03468 2026-04-09 cs.CV 57%

D-Garment: Physically Grounded Latent Diffusion for Dynamic Garment Deformations

D-Garment:基于物理的潜在扩散模型用于动态服装变形

Antoine Dumoulin, Adnane Boukhayma, Laurence Boissieux, Bharath Bhushan Damodaran, Pierre Hellier, Stefanie Wuhrer

机构 * Inria Centre at the University Grenoble Alpes(格勒诺布尔阿尔卑斯大学Inria研究中心) Inria, University of Rennes, CNRS, IRISA-UMR 6074(雷恩大学Inria、CNRS、IRISA-UMR 6074) InterDigital Inc.(InterDigital公司)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出D-Garment,通过基于物理的模拟器生成新数据,学习基于物理材料属性的3D生成模型,实现更准确的服装变形和动态皱纹模拟。

Comments 18 pages, 11 figures

Journal ref Transactions on Machine Learning Research (TMLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏