arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-05-13 至 2026-05-13 共收录 26 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 3 篇

2605.10360 2026-05-13 cs.CV 86%

DySurface: Consistent 4D Surface Reconstruction via Bridging Explicit Gaussians and Implicit Functions

DySurface: 通过连接显式高斯和隐式函数实现一致的4D表面重建

Minje Kim, Younghyun Noh, Jaesoon Kim, Tae-Kyun Kim

机构 * KAIST(韩国科学技术院) Sungkyunkwan University(全北国立大学)

专题命中 三维重建 :NeRF(abstract,abstract_cn);3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);novel view synthesis(abstract)

AI总结 本文提出DySurface框架,通过连接显式高斯和隐式SDF,解决动态场景中几何表面重建的连续性问题,提升表面重建质量与边界完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11354 2026-05-13 cs.CV 79%

Lite3R: A Model-Agnostic Framework for Efficient Feed-Forward 3D Reconstruction

Lite3R: 一种高效的端到端3D重建模型无关框架

Haoyu Zhang, Zeyu Zhang, Zedong Zhou, Yang Zhao, Hao Tang

机构 * Peking University(北京大学) La Trobe University(拉特罗布大学)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 本文提出Lite3R框架,通过稀疏线性注意力和FP8-aware量化训练,提升3D重建效率,降低延迟和内存使用,同时保持重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24577 2026-05-13 cs.CV cs.AI 79%

EndoVGGT: GNN-Enhanced Depth Estimation for Surgical 3D Reconstruction

EndoVGGT:基于图神经网络的手术3D重建中的深度估计

Falong Fan, Yi Xie, Arnis Lektauers, Bo Liu, Jerzy Rozenblit

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 本文提出EndoVGGT框架,通过DeGAT模块动态构建语义图谱,提升手术3D重建的几何连续性和非刚性变形恢复能力,实验表明其在PSNR和SSIM上优于现有方法,并具备跨数据集泛化能力。

Comments We withdraw this submission due to significant errors in the presentation and logical structure of the paper. We found that the current version does not accurately convey the research findings and requires a major overhaul of the manuscript's methodology description and results analysis

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 12 篇

2605.12437 2026-05-13 cs.CV 94%

3D Gaussian Splatting for Efficient Retrospective Dynamic Scene Novel View Synthesis with a Standardized Benchmark

基于3D高斯点划的高效回顾性动态场景新视角合成与标准化基准

Yunxiao Zhang, Suryansh Kumar

机构 * Visual and Spatial AI Lab(视觉与空间人工智能实验室) VCCM Section College of PVFA(VCCM学院光电工程学院) Department of ECEN(电子工程系) Department of CSCE(计算机科学与工程系) Texas A&M University(德克萨斯A&M大学)

专题命中 Gaussian Splatting :NeRF(summary_cn,abstract);3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract);novel view synthesis(title,abstract)

AI总结 本文提出基于同步多视角动态场景的3D高斯点划方法,无需时间耦合约束即可实现高效回顾性动态场景新视角合成,并构建了标准化的动态多视角数据集框架以支持可重复的NeRF和3DGS研究。

Comments Accepted for publication at CVPR 2026; 4D World Models Workshop. Draft info: 14 pages, 4 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11266 2026-05-13 cs.CV cs.GR cs.LG 93%

PG-3DGS: Optimizing 3D Gaussian Splatting to Satisfy Physics Objectives

PG-3DGS:优化3D高斯点云以满足物理目标

Zachary Lee, Maxwell Jacobson, Yexiang Xue

机构 * Department of Computer Science, Purdue University(普渡大学计算机科学系)

专题命中 Gaussian Splatting :3DGS(title,title_cn);Gaussian Splatting(title,abstract);分类 cs.CV、cs.GR

AI总结 PG-3DGS通过结合可微物理模拟与3D高斯表示,生成符合物理功能的3D结构,实现视觉与物理功能的平衡。

Comments Submitted to Artificial Intelligence. 52 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11489 2026-05-13 cs.GR cs.CV 91%

3DGS$^3$: Joint Super Sampling and Frame Interpolation for Real-Time Large-Scale 3DGS Rendering

3DGS$^3$:联合超采样与帧插值用于实时大规模3DGS渲染

Yibo Zhao, Fan Gao, Youcheng Cai, Ligang Liu

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 Gaussian Splatting :3DGS(title,title_cn);Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 本文提出3DGS$^3$框架,通过联合超采样和帧插值提升实时大规模3DGS渲染的效率与质量,采用可微处理实现高分辨率和高帧率输出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14199 2026-05-13 eess.IV cs.CV eess.SP 91%

Learnable Multi-level Discrete Wavelet Transforms for 3D Gaussian Splatting Frequency Modulation

可学习的多级离散小波变换用于3D高斯点划频率调制

Hung Nguyen, An Le, Truong Nguyen

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract);3D reconstruction(abstract);novel view synthesis(abstract)

AI总结 本文提出基于多级DWT的3DGS频率调制框架,通过递归分解低频子带,构建更深层的课程,减少高斯点数量并保持渲染质量。

Comments Accepted to EUSIPCO 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11432 2026-05-13 eess.SP 88%

XFreq-GS: Cross-Frequency Wireless Radiation Field Reconstruction with 3D Gaussian Splatting

XFreq-GS: 基于3D高斯点云的跨频无线辐射场重建

Sheng Wang, Hengtao He, Chaozheng Wen, Jingwen Tong, Xinyu Li, Xiao Li, Jun Zhang, Shi Jin

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract)

AI总结 本文提出XFreq-GS框架,通过共享几何和频适应射频属性的3D高斯点云实现跨频无线辐射场重建,并合成功率角谱图,优于现有3DGS方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11427 2026-05-13 cs.CV 87%

PD-4DGS:Progressive Decomposition of 4D Gaussian Splatting for Bandwidth-Adaptive Dynamic Scene Streaming

PD-4DGS:4D高斯散射的渐进分解用于带宽自适应动态场景流媒体

Jiachen Li, Guangzhi Han, Jin Wan, Delong Han, Yuan Gao, Min Li, Mingle Zhou, Gang Li

机构 * Qilu University of Technology(青岛理工大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);novel view synthesis(abstract);分类 cs.CV

AI总结 PD-4DGS通过渐进压缩和按需传输实现4D高斯散射的高效流媒体,减少带宽消耗并降低延迟,提升动态场景渲染性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12144 2026-05-13 cs.CV 86%

PoseCompass: Intelligent Synthetic Pose Selection for Visual Localization

PoseCompass: 用于视觉定位的智能合成姿态选择

Yanan Zhou, Zhaoyan Qian, Yanli Li, Nan Yang, Zhongliang Guo, Dong Yuan

机构 * The University of Sydney(悉尼大学) University of St Andrews(圣安德鲁大学)

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 PoseCompass通过智能姿态选择提升基于3DGS的APR性能,减少适应时间并降低姿态误差,优于随机基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12399 2026-05-13 cs.CV 84%

GeoQuery: Geometry-Query Diffusion for Sparse-View Reconstruction

GeoQuery: 用于稀疏视角重建的几何-查询扩散

Xiao Cao, Yuze Li, Youmin Zhang, Jiayu Song, Cheng Yan, Wen Li, Lixin Duan

机构 * University of Electronic Science Tianjin University Tianjin China Tianjin University

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);3D reconstruction(abstract);novel view synthesis(abstract)

AI总结 本文提出GeoQuery,通过几何引导的扩散框架,在稀疏视角重建中有效减少渲染伪影。

Comments Accept to SIGGRAPH 2026 Conference Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11424 2026-05-13 cs.CV 79%

VidSplat: Gaussian Splatting Reconstruction with Geometry-Guided Video Diffusion Priors

VidSplat:基于几何引导视频扩散先验的高斯点云重建

Jimin Tang, Wenyuan Zhang, Junsheng Zhou, Zian Huang, Kanle Shi, Shenkun Xu, Yu-Shen Liu, Zhizhong Han

机构 * School of Software, Tsinghua University(清华大学软件学院) Department of Computer Science, Wayne State University(韦恩州立大学计算机科学系)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 VidSplat通过几何引导的视频扩散先验,解决稀疏视图下3D场景重建问题,提出免训练生成框架,迭代合成新视角以恢复完整3D场景。

Comments Accepted by SIGGRAPH Conference 2026. Project Page: https://tangjm24.github.io/VidSplat

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11144 2026-05-13 cs.RO 79%

Forecast-aware Gaussian Splatting for Predictive 3D Representation in Language-Guided Pick-and-Place Manipulation

面向预测的高斯点散布用于语言引导的抓取与放置操作中的预测3D表示

Kaixin Jia, Jiacheng Xu

机构 * KTH Royal Institute of Technology(皇家理工学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.RO

AI总结 本文提出Forecast-GS框架,通过预测3D状态提升语言引导的机器人操作性能,实验显示其在抓取与放置任务中优于基线方法,表明明确预测任务完成状态有助于更可靠的行动评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11594 2026-05-13 cs.CV 77%

PointForward: Feedforward Driving Reconstruction through Point-Aligned Representations

PointForward:通过点对齐表示实现馈送驾驶重建

Cheng Chi, Xianqi Wang, Hongcheng Luo, Mingfei Tu, Gangwei Xu, Zehan Zhang, Bing Wang, Guang Chen, Hangjun Ye, Sida Peng, Xin Yang, Haiyang Sun

机构 * Xiaomi EV(小米电动车) Huazhong University of Science and Technology(华中科技大学) Zhejiang University(浙江大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 PointForward通过点对齐表示实现驾驶场景重建,采用空间时间融合提升多视角一致性,引入场景图处理动态实例,实现高精度驾驶场景重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12494 2026-05-13 cs.CV 70%

Revisiting Photometric Ambiguity for Accurate Gaussian-Splatting Surface Reconstruction

重新审视光度歧义以实现高精度高斯-散射表面重建

Jiahe Li, Jiawei Zhang, Xiao Bai, Jin Zheng, Xiaohan Yu, Lin Gu, Gim Hee Lee

机构 * School of Computer Science Engineering, State Key Laboratory of Complex Critical \& Software Environment, Jiangxi Research Institute, Beihang University State Key Laboratory of Virtual Reality Technology Macquarie University Tohoku University School of Computing, National University of Singapore

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出AmbiSuR框架,通过高斯散射内在解决方案解决光度歧义问题,提升3D表面重建性能,实验显示在多种挑战场景中表现优异。

Comments Accepted at ICML 2026. Project page: https://fictionarry.github.io/AmbiSuR-Proj/

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 10 篇

2605.11520 2026-05-13 cs.CV cs.AI 88%

PointGS: Semantic-Consistent Unsupervised 3D Point Cloud Segmentation with 3D Gaussian Splatting

PointGS: 基于3D高斯散射的语义一致无监督3D点云分割

Yixiao Song, Qingyong Li, Wen Wang, Zhicheng Yan

机构 * Key Laboratory of Big Data & Artificial Intelligence in Transportation (Beijing Jiaotong University), Ministry of Education(大数据与人工智能在交通运输中的关键实验室(北京交通大学),教育部) Frontiers Science Center for Smart High-speed Railway System, Beijing Jiaotong University(智能高速铁路系统前沿科学中心,北京交通大学)

专题命中 点云 :Gaussian Splatting(title,abstract);point cloud(title,abstract);分类 cs.CV

AI总结 PointGS通过3D高斯散射统一中间表示,解决3D点云与2D图像的语义一致性问题,实现无监督分割,优于现有方法,在ScanNet-V2和S3DIS上分别提升0.9%和2.8%的mIoU。

Comments Accepted by Computer Vision and Pattern Recognition (CVPR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.02011 2026-05-13 cs.CV 79%

PointCaM: Cut-and-Mix for Open-Set Point Cloud Learning

PointCaM:用于开放集点云学习的Cut-and-Mix

Jie Hong, Shi Qiu, Weihao Li, Saeed Anwar, Mehrtash Harandi, Nick Barnes, Lars Petersson

机构 * The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) Australian National University(澳大利亚国立大学) The University of Western Australia(西澳大学) Monash University(墨尔本大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出PointCaM方法,通过Unknown-Point Simulator和Estimator模块解决开放集点云学习问题,利用多级特征上下文提升未知对象识别性能。

Comments Accepted in CVIU

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11267 2026-05-13 cs.CV 57%

Real-Scale Island Area and Coastline Estimation using Only its Place Name or Coordinates

基于仅地名或坐标的真实尺度岛屿面积和海岸线估算

Quanyun Wu, Kyle Gao, Wentao Sun, Hongjie He, Yuhao Chen, David A. Clausi, Jonathan Li

机构 * East China Normal University(东华大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出基于纯单目视觉的真实尺度岛屿测量框架,通过自动化流程降低测绘成本,实现高效率测量。系统仅需输入目标区域的地理坐标或名称,即可获取低空影像序列,利用轻量级轨迹对齐算法恢复物理尺度,实现高精度面积和周长提取。

Comments Accepted for publication at IEEE OCEANS (Sanya) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10996 2026-05-13 cs.CG cs.AI cs.GR math.OC 57%

Towards Scalable Persistence-Based Topological Optimization

面向可扩展的基于持续性的拓扑优化

Abderrahim Bendahi, Alexandre Duplessis, Arnaud Fickinger

机构 * École Polytechnique Paris(巴黎高等理工学院) ENS Ulm, PSL Paris(乌尔姆国立高等学院,巴黎PSL) UC Berkeley(伯克利大学)

专题命中 点云 :point cloud(abstract);分类 cs.GR

AI总结 本文提出一种更可扩展的拓扑优化流程,通过随机切片和Nadaraya-Watson高斯卷积改进子采样和梯度扩展,提升持续性优化的效率与效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01418 2026-05-13 cs.CV cs.LG 57%

Parabolic Position Encoding: Vision-Centric, Principled, Extrapolatable, General

抛物线位置编码:以视觉为中心、原理性、可外推、通用

Christoffer Koo Øhrstrøm, Rafael I. Cabral Muchacho, Yifei Dong, Filippos Moumtzidellis, Ronja Güldenring, Florian T. Pokorny, Lazaros Nalpantidis

机构 * Technical University of Denmark(丹麦技术大学) KTH Royal Institute of Technology(皇家理工学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出基于抛物线的位置编码PaPE,用于视觉模态的注意力架构。通过考虑视觉模态特性,PaPE在图像净胜率上提升最高达10.5%,并在8个数据集上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05269 2026-05-13 cs.CV 57%

B4DL: A Benchmark for 4D LiDAR LLM in Spatio-Temporal Understanding

B4DL:用于空间时间理解的4D激光雷达LLM基准

Changho Choi, Youngwoo Shin, Gyojin Han, Dong-Jae Lee, Junmo Kim

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出B4DL基准,用于训练和评估多模态大语言模型对4D激光雷达数据的理解,结合可扩展的数据生成管道和新模型,实现动态户外环境的空间时间推理。

Comments Accepted at ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13311 2026-05-13 cs.CV cs.AI 57%

A Resource Efficient Fusion Network for Object Detection in Bird's-Eye View using Camera and Raw Radar Data

一种用于鸟瞰图中物体检测的资源高效融合网络:使用摄像头和原始雷达数据

Kavin Chandrasekaran, Sorin Grigorescu, Gijs Dubbelman, Pavol Jancura

机构 * ElektroBit Automotive GmbH Eindhoven University of Technology(埃因霍温理工大学) Transilvania University of Brasov(布拉索夫特拉扬大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出一种资源高效的融合网络,通过直接使用雷达原始范围-多普勒谱数据和摄像头图像处理,提升鸟瞰图中物体检测的准确性和效率。

Comments IEEE Intelligent Transportation Systems Conference (ITSC) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11828 2026-05-13 eess.SP 50%

PointNeRT: A Physics Aware Neural Ray Tracing Surrogate for Propagation Channel Modeling

PointNeRT:一种物理感知的神经射线追踪替代模型用于传播信道建模

Zhuoyin Li, Ruisi He, Mi Yang, Ziyi Qi, Zhengyu Zhang, Jiahui Han, Haoxiang Zhang, Bingcheng Liu

专题命中 点云 :point cloud(abstract)

AI总结 PointNeRT通过点云输入高效重建多径传播,无需显式构建网格模型或手动定义电磁交互规则,实现物理约束下的多径预测与功率衰减建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11270 2026-05-13 math.OC 50%

A Unified Approach for Computing Wasserstein Barycenters of Discrete and Continuous Measures

计算离散和连续测度的Wasserstein均值的统一方法

Peng Xu, Changbo Zhu, Xiaohui Chen

专题命中 点云 :point cloud(abstract)

AI总结 本文提出一种统一的对偶镜像下降算法,用于在Fisher-Rao几何中精确计算Wasserstein均值,能够处理离散和绝对连续输入测度,并在两种情况下保证收敛性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11008 2026-05-13 cs.LG cs.AI 50%

When and How to Canonize: A Generalization Perspective

何时以及如何规范化:从一般化角度出发

Yonatan Sverdlov, Benjamin Friedman, Snir Hordan, Nadav Dym

机构 * Technion – Israel Institute of Technology(技术学院–以色列理工学院)

专题命中 点云 :point cloud(abstract)

AI总结 本文从一般化角度分析了规范化的理论属性,提出通过覆盖数上界分析规范化的泛化误差,建立了规范化的泛化误差层次,并证明了Hilbert曲线规范化的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 新视角合成 1 篇

2605.12169 2026-05-13 cs.CV 57%

UniFixer: A Universal Reference-Guided Fixer for Diffusion-Based View Synthesis

UniFixer:一种通用参考引导的扩散基视图合成修复器

Sihan Chen, Xiang Zhang, Yang Zhang, Tunc Aydin, Christopher Schroers

机构 * ETH Zürich(苏黎世联邦理工学院) DisneyResearch|Studios(迪士尼研究实验室)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 本文提出UniFixer,通过粗到细策略修复扩散基视图合成中的多种退化问题,包括空间、时间及模型相关的退化,通过参考预对齐、全局结构锚定和局部细节注入模块实现高质量视图合成。

详情

展开后加载摘要…

URL PDF HTML 收藏