arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-03-04 至 2026-03-04 共收录 20 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 6 篇

2603.02134 2026-03-04 cs.CV 85%

OnlineX: Unified Online 3D Reconstruction and Understanding with Active-to-Stable State Evolution

OnlineX: 一种基于主动到稳定状态演化的统一在线3D重建与理解方法

Chong Xia, Fangfu Liu, Yule Wang, Yize Pang, Yueqi Duan

机构 * Tsinghua University(清华大学)

专题命中 三维重建 :3D reconstruction(title);Gaussian Splatting(abstract);3DGS(abstract);novel view synthesis(abstract)

AI总结 OnlineX通过解耦主动到稳定状态演化范式,实现基于流式图像的统一在线3D重建与理解,提升重建质量和实时推理效率。

Comments Accepted by CVPR Finding 2026 (Project page: https://xiac20.github.io/OnlineX/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08862 2026-03-04 cs.CV cs.LG 83%

StreamSplat: Towards Online Dynamic 3D Reconstruction from Uncalibrated Video Streams

StreamSplat: 向动态3D重建的在线方法:从未校准视频流中

Zike Wu, Qi Yan, Xuanyu Yi, Lele Wang, Renjie Liao

机构 * University of British Columbia(不列颠哥伦比亚大学) Vector Institute for AI(人工智能向量研究所) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席) Nanyang Technological University(南洋理工大学)

专题命中 三维重建 :3D reconstruction(title);Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 StreamSplat通过在线动态3D重建方法,实现从未校准视频流中快速生成高精度3DGS表示,支持任意长度视频的实时重建。

Comments Accepted by ICLR 2026, Project page: https://streamsplat3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26645 2026-03-04 cs.CV 79%

TTT3R: 3D Reconstruction as Test-Time Training

TTT3R: 3D重建作为测试时训练

Xingyu Chen, Yue Chen, Yuliang Xiu, Andreas Geiger, Anpei Chen

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Uni of Tübingen, Tübingen AI Center(图宾根大学,图宾根人工智能中心)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 TTT3R通过测试时训练方法提升3D重建的长度泛化能力,实现全局姿态估计性能提升2倍,运行效率高且内存消耗低。

Comments Page: https://rover-xingyu.github.io/TTT3R/ Code: https://github.com/Inception3D/TTT3R

Journal ref International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02985 2026-03-04 cs.CV 70%

The Dresden Dataset for 4D Reconstruction of Non-Rigid Abdominal Surgical Scenes

德里森数据集用于非刚性腹部手术场景的4D重建

Reuben Docea, Rayan Younis, Yonghao Long, Maxime Fleury, Jinjing Xu, Chenyang Li, André Schulze, Ann Wierick, Johannes Bender, Micha Pfeiffer, Qi Dou, Martin Wagner, Stefanie Speidel

机构 * Department of Translational Surgical Oncology, National Center for Tumor Diseases (NCT), NCT/UCC Dresden, a partnership between DKFZ, Faculty of Medicine and University Hospital Carl Gustav Carus, TUD Dresden University of Technology, and Helmholtz-Zentrum Dresden-Rossendorf (HZDR), Dresden, Germany(转化外科肿瘤中心部门,肿瘤疾病国家中心(NCT),NCT/UCC德累斯顿,由DKFZ、医学院和卡尔·戈斯瓦尔德·卡尔医院、德累斯顿技术大学以及德累斯顿-罗斯恩多夫赫尔姆霍兹中心(HZDR)组成的合作机构,德累斯顿,德国) Department of Translational Surgical Oncology, NCT/UCC Dresden, Faculty of Medicine and University Hospital Carl Gustav Carus, TUD Dresden University of Technology(转化外科肿瘤中心部门,NCT/UCC德累斯顿,医学院和卡尔·戈斯瓦尔德·卡尔医院,德累斯顿技术大学) Department for Visceral, Thoracic and Vascular Surgery, Faculty of Medicine and University Hospital Carl Gustav Carus, Technische Universität Dresden(visceral、胸腔和血管外科部门,医学院和卡尔·戈斯瓦尔德·卡尔医院,德累斯顿技术大学) Centre for Tactile Internet with Human-in-the-Loop (CeTI), Technical University Dresden(人机交互触觉互联网中心(CeTI),德累斯顿技术大学) Department of Computer Science and Engineering, The Chinese University of Hong Kong(计算机科学与工程部门,香港中文大学)

专题命中 三维重建 :3D reconstruction(abstract);point cloud(abstract);分类 cs.CV

AI总结 D4D数据集通过提供高精度结构光几何与内窥镜视频,为非刚性腹部手术场景的4D重建和深度估计方法提供全面评估基准。

Comments 16 pages, 10 figures, accompanying data descriptor for dataset, submitted to Scientific Data

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02582 2026-03-04 cs.CV eess.SP 57%

Neural Electromagnetic Fields for High-Resolution Material Parameter Reconstruction

神经电磁场用于高分辨率材料参数重建

Zhe Chen, Peilin Zheng, Wenshuo Chen, Xiucheng Wang, Yutao Yue, Nan Cheng

机构 * Xidian University(西安电子科技大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 三维重建 :NeRF(abstract);分类 cs.CV

AI总结 NEMF通过非侵入式物理反演构建功能数字孪生,实现高精度材料参数重建与物理模拟。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02351 2026-03-04 cs.CV 57%

MERG3R: A Divide-and-Conquer Approach to Large-Scale Neural Visual Geometry

MERG3R: 一种用于大规模神经视觉几何的分而治之方法

Leo Kaixuan Cheng, Abdus Shaikh, Ruofan Liang, Zhijie Wu, Yushi Guan, Nandita Vijaykumar

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 MERG3R通过分而治之的方法提升大规模神经视觉几何重建的准确性、内存效率和可扩展性。

Comments Project page: https://leochengkx.github.io/MERG3R/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 1 篇

2406.17438 2026-03-04 cs.CV 70%

Implicit-Zoo: A Large-Scale Dataset of Neural Implicit Functions for 2D Images and 3D Scenes

隐式动物园:一个大规模神经隐式函数数据集,用于2D图像和3D场景

Qi Ma, Danda Pani Paudel, Ender Konukoglu, Luc Van Gool

机构 * Computer Vision Lab, ETH Zurich(苏黎世联邦理工学院计算机视觉实验室) INSAIT, Sofia University(索菲亚大学INSAIT)

专题命中 NeRF :3D vision(abstract);NeRF(abstract);分类 cs.CV

AI总结 隐式动物园是一个大规模神经隐式函数数据集,用于2D图像和3D场景,通过提供高质量数据促进研究,提升图像分类、语义分割和3D姿态回归性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 8 篇

2603.02866 2026-03-04 cs.CV 89%

Multimodal-Prior-Guided Importance Sampling for Hierarchical Gaussian Splatting in Sparse-View Novel View Synthesis

多模态先验引导的重要性采样用于稀疏视图新视图合成中的分层高斯点云

Kaiqiang Xiong, Zhanke Wang, Ronggang Wang

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology(广东超高清沉浸媒体技术重点实验室) Shenzhen Graduate School, Peking University(北京大学深圳研究生院) Peng Cheng Laboratory(鹏城实验室) Migu Culture Technology Co., Ltd.(米果文化科技有限公司)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);novel view synthesis(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 本文提出多模态先验引导的重要性采样方法,用于稀疏视图新视图合成中的分层高斯点云,通过融合光度残差、语义和几何先验,提升重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01099 2026-03-04 cs.CV 85%

HeroGS: Hierarchical Guidance for Robust 3D Gaussian Splatting under Sparse Views

HeroGS:用于稀疏视角下鲁棒三维高斯点扩散的分层引导

Jiashu Li, Xumeng Han, Zhaoyang Wei, Zipeng Wang, Kuiran Wang, Guorong Li, Zhenjun Han, Jianbin Jiao

机构 * University of the Chinese Academy of Sciences(中国科学院大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 HeroGS通过分层引导策略在稀疏视角下提升三维高斯点扩散的鲁棒性和重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02801 2026-03-04 cs.CV 84%

R3GW: Relightable 3D Gaussians for Outdoor Scenes in the Wild

R3GW:用于野外户外场景的可重照明3D高斯

Margherita Lea Corona, Wieland Morgenstern, Peter Eisert, Anna Hilsmann

机构 * Fraunhofer Heinrich Hertz Institute(弗劳恩霍夫海因里希·赫茨研究所)

专题命中 Gaussian Splatting :NeRF(abstract);Gaussian Splatting(abstract);3DGS(abstract);3D reconstruction(abstract)

AI总结 R3GW通过结合基于物理的渲染与3DGS,实现了野外户外场景的可重照明3D重建和高质量新视角合成。

Comments Accepted at VISAPP 2026

Journal ref Proc. VISAPP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02986 2026-03-04 cs.CV cs.GR 82%

VIRGi: View-dependent Instant Recoloring of 3D Gaussians Splats

VIRGi: 基于3D高斯溅射的视图依赖性即时重绘

Alessio Mazzucchelli, Ivan Ojeda-Martin, Fernando Rivas-Manzaneque, Elena Garces, Adrian Penate-Sanchez, Francesc Moreno-Noguer

机构 * Arquimea Research Center(阿基米德研究中心) Universidad Politécnica de Catalunya(加泰罗尼亚理工大学) Volinga AI Universidad Politécnica de Madrid(马德里理工大学) Universidad Rey Juan Carlos(雷伊·胡安·卡洛斯大学) IUSANI, Universidad de Las Palmas de Gran Canaria(IUSANI,拉斯帕尔马斯德格兰坎亚大学) Institut de Robòtica i Informàtica Industrial (IRI), CSIC-UPC(机器人与信息技术研究所(IRI),CSIC-UPC)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);3D reconstruction(abstract);novel view synthesis(abstract)

AI总结 VIRGi通过分离颜色为漫反射和视图依赖成分,实现对3DGS场景的快速重绘,提升实时交互与视图依赖效果控制。

Comments IEEE Transactions on Pattern Analysis and Machine Intelligence. 2026 Feb 24

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02548 2026-03-04 cs.CV 79%

SemGS: Feed-Forward Semantic 3D Gaussian Splatting from Sparse Views for Generalizable Scene Understanding

SemGS:从稀疏视图中进行前馈语义3D高斯点云分割以实现可泛化的场景理解

Sheng Ye, Zhen-Hui Dong, Ruoyu Fan, Tian Lv, Yong-Jin Liu

机构 * Department of Computer Science, Tsinghua University(计算机科学系,清华大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title);novel view synthesis(abstract);分类 cs.CV

AI总结 SemGS通过双分支架构和相机感知注意力机制,从稀疏视图中高效重建可泛化的语义3D场,实现快速推理和广泛适用性。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02893 2026-03-04 cs.CV 74%

Intrinsic Geometry-Appearance Consistency Optimization for Sparse-View Gaussian Splatting

内在几何-外观一致性优化用于稀疏视角高斯点绘制

Kaiqiang Xiong, Rui Peng, Jiahao Wu, Zhanke Wang, Jie Liang, Xiaoyun Zheng, Feng Gao, Ronggang Wang

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology, Shenzhen Graduate School, Peking University(广东超高清沉浸媒体技术省重点实验室,深圳大学,北京大学) Peng Cheng Laboratory(鹏城实验室) Migu Culture Technology Co., Ltd(咪咕文化技术有限公司) Alibaba Group(阿里巴巴集团) School of Arts, Peking University(北京大学艺术学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV

AI总结 MVD-HuGaS通过多视角扩散模型实现从单张图像生成自由视角3D人体,结合几何-外观一致性优化提升重建保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02910 2026-03-04 cs.CV 57%

Articulation in Motion: Prior-free Part Mobility Analysis for Articulated Objects By Dynamic-Static Disentanglement

运动中的关节性:通过动态-静态解耦实现无先验知识的关节物体部分移动分析

Hao Ai, Wenjie Chang, Jianbo Jiao, Ales Leonardis, Ofek Eyal

机构 * School of Computer Science, University of Birmingham(伯明翰大学计算机科学学院) University of Science and Technology of China(中国科学技术大学)

专题命中 Gaussian Splatting :3DGS(abstract);分类 cs.CV

AI总结 本文提出了一种无需先验知识的关节物体部分移动分析方法,通过动态-静态解耦实现高质量的3D重建与分割。

Comments Accepted by ICLR 2026. Project Page: https://haoai-1997.github.io/AiM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20508 2026-03-04 stat.ML cs.LG 50%

Fast Estimation of Wasserstein Distances via Regression on Sliced Wasserstein Distances

通过回归切片Wasserstein距离快速估计Wasserstein距离

Khai Nguyen, Hai Nguyen, Nhat Ho

机构 * Department of Statistics and Data Sciences University of Texas at Austin(统计与数据科学系得克萨斯大学奥斯汀分校)

专题命中 Gaussian Splatting :point cloud(abstract)

AI总结 本文提出通过回归切片Wasserstein距离快速估计Wasserstein距离的方法,该方法在多种任务中表现出色,尤其在低数据情况下优于现有模型。

Comments Accepted to ICLR 2026, 34 pages, 30 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 1 篇

2603.02896 2026-03-04 cs.CV 57%

3D-DRES: Detailed 3D Referring Expression Segmentation

3D-DRES: 详细3D指称表达分割

Qi Chen, Changli Wu, Jiayi Ji, Yiwei Ma, Liujuan Cao

专题命中 点云 :3D vision(abstract);分类 cs.CV

AI总结 3D-DRES通过引入DetailRefer数据集和DetailBase架构,提升3D视觉语言理解的细粒度分割能力。

Comments AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 空间理解 4 篇

2603.03002 2026-03-04 cs.AI 71%

SpatialText: A Pure-Text Cognitive Benchmark for Spatial Understanding in Large Language Models

SpatialText: 一种纯文本的认知基准,用于大型语言模型中的空间理解

Peiyao Jiang, Zequn Qin, Xi Li

机构 * Zhejiang University(浙江大学) School of Software Technology, Zhejiang University(软件技术学院,浙江大学)

专题命中 空间理解 :spatial understanding(title)

AI总结 SpatialText通过双源方法为大型语言模型提供纯文本空间认知基准,揭示其在空间推理中的系统性缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02609 2026-03-04 cs.CV cs.RO 62%

VLMFusionOcc3D: VLM Assisted Multi-Modal 3D Semantic Occupancy Prediction

VLMFusionOcc3D: 基于VLM的多模态3D语义占位预测

A. Enes Doruk, Hasan F. Ates

机构 * Department of Artificial Intelligence and Data Engineering, Ozyegin University(人工智能与数据工程系,奥克辛大学)

专题命中 空间理解 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 VLMFusionOcc3D通过融合视觉语言模型的语义先验,提升多模态3D语义占位预测的鲁棒性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02724 2026-03-04 cs.SD cs.LG 50%

Single Microphone Own Voice Detection based on Simulated Transfer Functions for Hearing Aids

基于模拟传输函数的单麦克风自身语音检测

Mathuranathan Mayuravaani, W. Bastiaan Kleijn, Andrew Lensen, Charlotte Sørensen

专题命中 空间理解 :spatial understanding(abstract)

AI总结 本文提出基于模拟传输函数的单麦克风自身语音检测方法,通过数据增强和层次化微调提升模型泛化能力,实现高准确率的OVD应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02498 2026-03-04 cs.HC 50%

Improving Low-Vision Chart Accessibility via On-Cursor Visual Context

通过光标视觉上下文提高低视力图表的可访问性

Yotam Sechayk, Hennes Rave, Max Rädler, Mark Colley, Zhongyi Zhou, Ariel Shamir, Takeo Igarashi

专题命中 空间理解 :spatial understanding(abstract)

AI总结 本文提出两种基于指针的交互方法,通过提供视觉上下文提高低视力者访问图表的能力,同时平衡视觉负荷。

Comments CHI '26, Barcelona, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏