arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-02-25 至 2026-02-25 共收录 20 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 7 篇

2506.14856 2026-02-25 cs.CV cs.AI 87%

Peering into the Unknown: Active View Selection with Neural Uncertainty Maps for 3D Reconstruction

窥探未知:基于神经不确定性地图的主动视角选择用于3D重建

Zhengquan Zhang, Feng Xu, Mengmi Zhang

机构 * Deep NeuroCognition Lab, Nanyang Technological University, Singapore(深神经认知实验室,南洋理工大学,新加坡) Fudan University, China(复旦大学,中国)

专题命中 三维重建 :3D reconstruction(title,abstract);NeRF(abstract);Gaussian Splatting(abstract);novel view synthesis(abstract)

AI总结 本文提出了一种基于神经不确定性地图的主动视角选择方法,通过轻量级神经网络预测视角不确定性,从而提升3D重建的准确性和效率。

Comments 10 pages, 4 figures in the main text. Published at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20718 2026-02-25 cs.CV 83%

Monocular Endoscopic Tissue 3D Reconstruction with Multi-Level Geometry Regularization

单目内窥镜组织三维重建与多级几何正则化

Yangsen Chen, Hao Wang

机构 * HKUST(GZ)(香港科技大学(珠海))

专题命中 三维重建 :3D reconstruction(title);NeRF(abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文提出基于3D高斯点的单目内窥镜组织三维重建方法,结合多级几何正则化实现平滑表面与实时渲染。

Comments ijcnn 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20584 2026-02-25 cs.CV cs.RO 76%

Long-Term Multi-Session 3D Reconstruction Under Substantial Appearance Change

长期多会话3D重建在显著外观变化下

Beverley Gorry, Tobias Fischer, Michael Milford, Alejandro Fontan

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV、cs.RO

AI总结 本文提出了一种在显著外观变化下实现长期多会话3D重建的方法,通过联合SfM重建和互补特征融合,实现了跨会话的一致重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20539 2026-02-25 eess.IV cs.CV 70%

Progressive Per-Branch Depth Optimization for DEFOM-Stereo and SAM3 Joint Analysis in UAV Forestry Applications

逐步分支深度优化用于UAV林业应用中的DEFOM-Stereo和SAM3联合分析

Yida Lin, Bing Xue, Mengjie Zhang, Sam Schofield, Richard Green

机构 * Centre for Data Science and Artificial Intelligence(数据科学与人工智能中心) Victoria University of Wellington(威灵顿维多利亚大学) Department of Computer Science and Software Engineering(计算机科学与软件工程系) University of Canterbury(坎特伯雷大学)

专题命中 三维重建 :3D reconstruction(abstract);point cloud(abstract);分类 cs.CV

AI总结 本文提出逐步分支深度优化方法,结合DEFOM-Stereo和SAM3,提升无人机林业中分支级3D重建精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20943 2026-02-25 cs.CV 57%

UFO: Unifying Feed-Forward and Optimization-based Methods for Large Driving Scene Modeling

UFO: 为大驾驶场景建模统一前馈和基于优化的方法

Kaiyuan Tan, Yingying Shen, Mingfei Tu, Haohui Zhu, Bing Wang, Guang Chen, Hangjun Ye, Haiyang Sun

机构 * Xiaomi EV(小米电动车) UIUC(伊利诺伊大学香槟分校)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 UFO通过结合优化和前馈方法,实现了高效长距离4D驾驶场景重建,能够在0.5秒内高质量重建16秒驾驶日志。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20306 2026-02-25 cs.LG cs.AI cs.NA math.NA 50%

Shape-informed cardiac mechanics surrogates in data-scarce regimes via geometric encoding and generative augmentation

基于几何编码和生成增强的形状感知心脏力学替代模型用于数据稀缺环境

Davide Carrara, Marc Hirschvogel, Francesca Bonizzoni, Stefano Pagani, Simone Pezzuto, Francesco Regazzoni

机构 * MOX Laboratory, Department of Mathematics, Politecnico di Milano(米兰Politecnico大学数学系MOX实验室) Division 2.2 Process Simulation, Bundesanstalt für Materialforschung und -prüfung (BAM)(材料研究所(BAM)第2.2过程模拟部) Department of Mathematics, University of Trento(特伦托大学数学系)

专题命中 三维重建 :point cloud(abstract)

AI总结 本文提出了一种基于几何编码和生成增强的两步框架,用于在数据稀缺条件下实现形状感知的心脏力学替代模型,通过学习紧凑的潜在表示和神经场模型,提高跨不同解剖结构的泛化能力。

Comments 39 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03723 2026-02-25 stat.AP stat.ME 50%

Bayesian Perspective for Orientation Determination in Cryo-EM with Application to Structural Heterogeneity Analysis

冷冻电镜中方向确定的贝叶斯视角及其在结构异质性分析中的应用

Sheng Xu, Amnon Balanov, Amit Singer, Tamir Bendory

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 本文提出了一种贝叶斯框架用于提高冷冻电镜中方向估计的准确性,通过MMSE估计器在低信噪比条件下显著提升三维分子结构重建的精度和鲁棒性,从而推动高保真构象景观重建。

Comments 33 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 7 篇

2602.20342 2026-02-25 cs.CV cs.RO 88%

Large-scale Photorealistic Outdoor 3D Scene Reconstruction from UAV Imagery Using Gaussian Splatting Techniques

基于高斯点扩散技术的无人机影像大规模真实感户外3D场景重建

Christos Maikos, Georgios Angelidis, Georgios Th. Papadopoulos

机构 * Department of Informatics and Telematics(信息学与电信学系)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);NeRF(abstract);3DGS(abstract);3D reconstruction(abstract)

AI总结 本文提出基于高斯点扩散技术的无人机影像大规模真实感户外3D场景重建方法,实现低延迟的高保真度3D重建。

Comments 7 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16030 2026-02-25 cs.CV 85%

CuriGS: Curriculum-Guided Gaussian Splatting for Sparse View Synthesis

CuriGS:基于课程指导的高斯点云法用于稀疏视角合成

Zijian Wu, Mingfeng Jiang, Zidian Lin, Ying Song, Hanjie Ma, Qun Wu, Dongping Zhang, Guiyang Pu

机构 * Zhejiang Sci-Tech University(浙江科技学院) China Jiliang University(中国嘉兴大学) Zhejiang University(浙江大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 CuriGS通过课程指导方法提升稀疏视角下3DGS的重建效果,实现更稳定的视角增强和更高的渲染保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20933 2026-02-25 cs.CV 83%

Dropping Anchor and Spherical Harmonics for Sparse-view Gaussian Splatting

丢弃锚点与球面谐波用于稀疏视角高斯点扩散

Shuangkang Fang, I-Chao Shen, Xuanyang Zhang, Zesheng Wang, Yufeng Wang, Wenrui Ding, Gang Yu, Takeo Igarashi

机构 * Beihang University(北京航空航天大学) The University of Tokyo(东京大学) StepFun

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 DropAnSH-GS通过引入锚点机制和球面谐波系数的Dropout策略,有效缓解稀疏视角下3DGS的过拟合问题,提升模型鲁棒性与压缩能力。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22908 2026-02-25 cs.CV eess.IV 80%

Learning Hierarchical Sparse Transform Coding for 3DGS Compression

学习分层稀疏变换编码用于3DGS压缩

Hao Xu, Xiaolin Wu, Xi Zhang

机构 * McMaster University, Canada(麦斯威尔大学) Nanyang Technological University, Singapore(南洋理工大学) Southwest Jiaotong University, China(西南交通大学)

专题命中 Gaussian Splatting :3DGS(title,abstract);分类 cs.CV

AI总结 本文提出了一种学习分层稀疏变换编码方法,通过引入分析-合成变换和联合优化3DGS表示与熵模型,提升3DGS压缩的R-D性能和解码效率。

Comments Our code will be released at \href{https://github.com/hxu160/SHTC_for_3DGS_compression}{here}

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20556 2026-02-25 cs.CV 57%

WildGHand: Learning Anti-Perturbation Gaussian Hand Avatars from Monocular In-the-Wild Videos

WildGHand: 从单目真实视频中学习抗扰动高斯手姿态体

Hanhui Li, Xuan Huang, Wanquan Liu, Yuhao Cheng, Long Chen, Yiqiang Yan, Xiaodan Liang, Chenqiang Gao

机构 * School of Intelligent Systems Engineering, Shenzhen Campus of Sun Yat-sen University(中山大学智能系统工程学院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 WildGHand通过动态扰动解耦模块和扰动感知优化策略,实现从真实视频中抗扰动的高斯手姿态体生成,取得多项指标上的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20363 2026-02-25 cs.CV 57%

Aesthetic Camera Viewpoint Suggestion with 3D Aesthetic Field

基于3D审美场的美观摄像机视角建议

Sheyang Tang, Armin Shafiee Sarvestani, Jialu Xu, Xiaoyu Xu, Zhou Wang

机构 * University of Waterloo(多伦多大学) City University of Hong Kong(香港城市大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文提出基于3D审美场的视角建议方法,通过3D高斯散点网络将2D审美模型的知识蒸馏到3D空间,实现高效且无需密集捕获或RL探索的美观视角搜索。

Comments 14 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12370 2026-02-25 cs.CV 57%

Changes in Real Time: Online Scene Change Detection with Multi-View Fusion

实时变化:多视角融合的在线场景变化检测

Chamuditha Jayanga Galappaththige, Jason Lai, Lloyd Windrim, Donald Dansereau, Niko Sünderhauf, Dimity Miller

机构 * QUT Centre for Robotics(昆士兰理工大学机器人中心) ARIAM ACFR, University of Sydney(悉尼大学先进计算机研究中心) Abyss Solutions

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文提出了一种基于多视角融合的在线场景变化检测方法,通过自监督融合损失、快速姿态估计和变化引导更新策略,在高帧率下实现了优于离线方法的性能。

Comments Accepted at CVPR 2026. Project Page: https://chumsy0725.github.io/O-SCD/

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 3 篇

2602.21195 2026-02-25 cs.CV 57%

Region of Interest Segmentation and Morphological Analysis for Membranes in Cryo-Electron Tomography

膜区域分割与形态学分析用于冷冻电镜显微镜

Xingyi Cheng, Julien Maufront, Aurélie Di Cicco, Daniël M. Pelt, Manuela Dezi, Daniel Lévy

机构 * Institut Curie, CNRS UMR168, Université PSL, Sorbonne Université, Paris, France(法国巴黎Curie研究所、CNRS UMR168、巴黎综合理工学院、索邦大学) Leiden Institute of Advanced Computer Science (LIACS), Universiteit Leiden, the Netherlands(荷兰莱顿大学莱顿先进计算机科学研究所(LIACS))

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出TomoROIS-SurfORA框架,用于直接分割膜区域并分析其形态学特征,适用于冷冻电镜及其他科学成像领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20653 2026-02-25 cs.CV 57%

SD4R: Sparse-to-Dense Learning for 3D Object Detection with 4D Radar

SD4R:基于4D雷达的稀疏到密集学习用于3D物体检测

Xiaokai Bai, Jiahao Cheng, Songkai Wang, Yixuan Luo, Lianqing Zheng, Xiaohan Zhang, Si-Yuan Cao, Hui-Liang Shen

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) Ningbo Global Innovation Center, Zhejiang University(浙江大学宁波全球创新中心) School of Automotive Studies, Tongji University(同济大学汽车学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 SD4R通过前景点生成器和对数几率查询编码器提升4D雷达点云的密集化能力,实现更鲁棒的3D物体检测性能。

Comments 7 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00618 2026-02-25 cs.CV 57%

RegTrack: Simplicity Beneath Complexity in Robust Multi-Modal 3D Multi-Object Tracking

RegTrack: 复杂性之下蕴含的简洁性在鲁棒多模态3D多目标跟踪中

Lipeng Gu, Xuefeng Yan, Song Wang, Mingqiang Wei

机构 * School of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(计算机科学与技术学院,南京航空航天大学) Shenzhen Institute of Research, Nanjing University of Aeronautics and Astronautics(深圳研究院,南京航空航天大学) Collaborative Innovation Center of Novel Software Technology and Industrialization, Nanjing, China(新型软件技术与产业化协同创新中心,南京,中国) School of Computer Science and Control Engineering, Shenzhen University of Advanced Technology(计算机科学与控制工程学院,深圳大学先进技术学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 RegTrack通过统一三 cue 编码器实现鲁棒、高效且通用的多模态3D多目标跟踪。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 空间理解 2 篇

2602.19768 2026-02-25 cs.CV 79%

TraceVision: Trajectory-Aware Vision-Language Model for Human-Like Spatial Understanding

TraceVision: 一种具有轨迹感知能力的视觉-语言模型,用于类人空间理解

Fan Yang, Shurong Zheng, Hongyin Zhao, Yufei Zhan, Xin Li, Yousong Zhu, Chaoyang Zhao Ming Tang, Jinqiao Wang

专题命中 空间理解 :spatial understanding(title,abstract);分类 cs.CV

AI总结 TraceVision通过整合轨迹感知的空间理解,实现了类人空间认知,提升视觉-语言模型在轨迹引导任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20476 2026-02-25 cs.CV 57%

SceMoS: Scene-Aware 3D Human Motion Synthesis by Planning with Geometry-Grounded Tokens

SceMoS:通过基于几何的令牌规划进行场景感知的3D人体运动合成

Anindita Ghosh, Vladislav Golyanik, Taku Komura, Philipp Slusallek, Christian Theobalt, Rishabh Dabral

机构 * DFKI(德累斯顿人工智能研究所) MPI for Informatics(信息研究所) Saarland Informatics Campus(萨尔州信息校园) University of Hong Kong(香港大学)

专题命中 空间理解 :point cloud(abstract);分类 cs.CV

AI总结 SceMoS通过基于几何的令牌规划,利用2D场景表示实现高效且逼真的3D人体运动合成,减少50%以上可训练参数,提升物理真实性和接触精度。

Comments 13 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

5. SLAM与定位 1 篇

2510.24332 2026-02-25 cs.SD cs.CV eess.AS eess.IV 57%

Sound Source Localization for Spatial Mapping of Surgical Actions in Dynamic Scenes

动态场景中手术动作空间映射的声源定位

Jonas Hein, Lazaros Vlachopoulos, Maurits Geert Laurent Olthof, Bastian Sigrist, Philipp Fürnstahl, Matthias Seibold

机构 * ROCS(罗克辛研究所) Balgrist University Hospital(巴尔格里斯大学医院) University of Zurich(苏黎世大学) Dept. of Orthopedics(骨科部门) Computer Vision and Geometry Group(计算机视觉与几何组) ETH Zurich(苏黎世联邦理工学院)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 本文提出一种动态手术场景中声源定位的方法,通过整合3D音频与视觉数据,提升手术场景的多模态理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏