arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-16 至 2026-06-16 共收录 20 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 4 篇

2606.16638 2026-06-16 cs.CV 新提交 85%

MVM-IOD: An Industrial Object-Centric Benchmark Dataset for the Evaluation of 3D Reconstruction Methods

MVM-IOD:用于评估3D重建方法的工业对象中心基准数据集

Robert Langendörfer, Markus Hillemann, Markus Ulrich

机构 * Machine Vision Metrology, Institute of Photogrammetry and Remote Sensing, Karlsruhe Institute of Technology, Germany(德国卡尔斯鲁厄理工学院摄影测量与遥感研究所机器视觉计量学)

专题命中 三维重建 :3D reconstruction(title,abstract);Gaussian Splatting(abstract);point cloud(abstract);分类 cs.CV

AI总结 针对工业场景3D重建评估数据集匮乏的问题,提出MVM-IOD数据集,包含工业对象图像、参考相机位姿和点云,并评估了多种SOTA方法,发现前馈方法对非分布图像敏感。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13655 2026-06-16 cs.CV cs.GR 新提交 62%

Flex4DHuman: Flexible Multi-view Video Diffusion for 4D Human Reconstruction

Flex4DHuman:面向4D人体重建的灵活多视角视频扩散模型

Jen-Hao Cheng, Yipeng Wang, Hao Zhang, Gengshan Yang, Jenq-Neng Hwang

机构 * University of Washington(华盛顿大学) World Labs

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 提出Flex4DHuman,一种基于相对相机位姿条件化的多视角视频扩散模型,无需显式几何先验即可将单目或稀疏多视角视频转换为密集多视角视频,并用于4D高斯溅射重建。

Comments Project Page: https://andy-cheng.github.io/Flex4DHuman/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16479 2026-06-16 cs.CV cs.AI 新提交 57%

Uncertainty Quality of VGGT: An Analysis on the DTU Benchmark Dataset

VGGT的不确定性质量:基于DTU基准数据集的分析

Markus Hillemann, Robert Langendörfer, Steven Landgraf, Markus Ulrich

机构 * Institute of Photogrammetry and Remote Sensing, Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院摄影测量与遥感研究所)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文分析VGGT模型在DTU数据集上的不确定性预测质量,确定有效置信度阈值,并证明提升不确定性质量可显著改善3D重建精度。

Comments Accepted for publication in the ISPRS Annals of the Photogrammetry, Remote Sensing and Spatial Information Sciences

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15681 2026-06-16 cs.CV 新提交 57%

3D Consistency Optimization for Self-Supervised Monocular Video Depth Estimation

自监督单目视频深度估计的3D一致性优化

Yuanye Liu, Ke Zhang, Junzhe Jiang, Li Zhang, Vishal Patel, Xiahai Zhuang

机构 * Fudan University(复旦大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出一种将视频深度估计转化为多视图3D重建的框架,通过光度渲染、世界坐标对齐和多尺度时间梯度一致性约束,实现全局3D结构一致性,在自监督和零样本临床场景中达到最先进的空间精度。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 8 篇

2606.15848 2026-06-16 cs.CV 新提交 89%

EmoZone-Talker: Regional Semantic Control of Audio-Driven 3DGS Talking Heads via Facial Action Units

EmoZone-Talker: 基于面部动作单元的音频驱动3DGS说话人头部的区域语义控制

Tingting Chen, Shaojun Wang, Huaye Zhang, Diqiong Jiang, Chenglizhao Chen

机构 * China University of Petroleum (East China)(中国石油大学(华东))

专题命中 Gaussian Splatting :3DGS(title,title_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出EmoZone-Talker框架,通过区域解耦和时序建模解决音频与表情信号的冲突,实现精细、可解释的面部表情控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16566 2026-06-16 cs.CV 新提交 87%

Local-GS: Accelerating 3D Gaussian Splatting via Tile-Local Warp Coherence

Local-GS:通过Tile局部Warp一致性加速3D高斯泼溅

Yang Luo, Yan Gong, Yongsheng Gao, Jie Zhao, Xinyu Zhang, Huaping Liu

机构 * State Key Laboratory of Robotics and Systems, Harbin Institute of Technology(哈尔滨工业大学机器人技术与系统国家重点实验室) State Key Laboratory of Intelligent Green Vehicle and Mobility, School of Vehicle and Mobility, Tsinghua University(清华大学车辆与运载学院智能绿色车辆与交通国家重点实验室) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);novel view synthesis(abstract);分类 cs.CV

AI总结 提出Local-GS,通过基于SIMT执行边界组织高斯原语,设计提升、剔除和混合三阶段warp一致渲染范式,在不降低质量的前提下实现最高7.76倍加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15924 2026-06-16 cs.CV cs.GR 新提交 86%

TurboGS: Accelerating 3D Gaussian Splatting via Error-Guided Sparse Pixel Sampling and Optimization

TurboGS: 通过误差引导的稀疏像素采样与优化加速3D高斯泼溅

Zheng Dong, Daifei Qiu, Pinxuan Dai, Ke Xu, Jiamin Xu, Lili He, Rynson W. H. Lau, Weiwei Xu

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.CV、cs.GR

AI总结 提出TurboGS框架,通过误差引导的稀疏像素采样、结构感知损失、动态密度控制和混合优化器,在保持高保真渲染质量的同时实现高达10倍的训练加速。

Comments Accepted by ICML2026. Project page: https://zhengdong.site/projects/TurboGS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16168 2026-06-16 cs.CV 新提交 83%

Fi-Gaussian: Frequency-Aware Implicit Gaussian Splatting for Single Image Dehazing

Fi-Gaussian:面向单图像去雾的频率感知隐式高斯泼溅

Yuhan Chen, Ying Fang, Guofa Li, Wenxuan Yu, Yicui Shi, Kunyang Huang, Wenbo Chu, Keqiang Li

机构 * College of Mechanical and Vehicle Engineering, Chongqing University(重庆大学机械与车辆工程学院) Department of Electrical and Computer Engineering, Carnegie Mellon University(卡内基梅隆大学电气与计算机工程系) National Innovation Center of Intelligent and Connected Vehicles(国家智能网联汽车创新中心) School of Vehicle and Mobility, Tsinghua University(清华大学车辆与运载学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);point cloud(abstract);分类 cs.CV

AI总结 提出Fi-Gaussian网络,利用频率感知隐式高斯泼溅模块解耦高低频信息并自适应聚合,结合物理散射重归一化机制,实现单图像去雾的SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16163 2026-06-16 cs.CV 新提交 79%

Dehaze-GaussianImage: Zero-Shot Dehazing via Efficient 2D Gaussian Splatting Representation

Dehaze-GaussianImage:基于高效2D高斯泼溅表示的零样本去雾

Yuhan Chen, Wenxuan Yu, Guofa Li, Kunyang Huang, Ying Fang, Yicui Shi, Wenbo Chu, Keqiang Li

机构 * College of Mechanical and Vehicle Engineering, Chongqing University(重庆大学机械与车辆工程学院) Department of Electrical and Computer Engineering, Carnegie Mellon University(卡内基梅隆大学电气与计算机工程系) National Innovation Center of Intelligent and Connected Vehicles(国家智能网联汽车创新中心) School of Vehicle and Mobility, Tsinghua University(清华大学车辆与运载学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 提出首个将2D高斯泼溅引入图像去雾的零样本框架,通过重建-解耦学习策略嵌入大气散射模型,实现几何级解耦和清晰纹理重建,以最少参数达到无监督SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16159 2026-06-16 cs.CV 新提交 79%

Continuous Splatting meets Retinex: Continuous Gaussian Splatting and Implicit Reflectance Modeling for Low-Light Image Enhancement

连续Splatting遇见Retinex:用于低光图像增强的连续高斯Splatting与隐式反射建模

Yuhan Chen, Yicui Shi, Guofa Li, Wenxuan Yu, Ying Fang, Guangrui Bai, Wenbo Chu, Keqiang Li

机构 * College of Mechanical and Vehicle Engineering, Chongqing University(重庆大学机械与运载工程学院) School of Engineering Science, University of Science and Technology of China(中国科学技术大学工程科学学院) National Innovation Center of Intelligent and Connected Vehicles(国家智能网联汽车创新中心) School of Vehicle and Mobility, Tsinghua University(清华大学车辆与运载学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 提出CGS-Retinex框架,结合连续高斯Splatting与Retinex理论,通过连续参数场估计全局光照,并利用隐式神经表示独立建模反射率,实现低光图像增强,有效抑制噪声和过曝,恢复高频结构和色彩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16232 2026-06-16 cs.RO 新提交 77%

PolyMerge: Compressing 3D Gaussian Splats with Polytope Coverings for Provably Safe Resource-Constrained Navigation

PolyMerge: 用多面体覆盖压缩3D高斯泼溅以实现可证明安全的资源受限导航

Jihoon Hong, Chih-Yuan Chiu, Sara Fridovich-Keil, Glen Chou

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.RO

AI总结 提出PolyMerge,将大规模3D高斯泼溅模型转换为凸多面体覆盖,保证覆盖原模型所有障碍物,结合控制障碍函数实现实时安全路径规划,在Crazyflie无人机上验证。

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 7, pp. 8512-8519, July 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15659 2026-06-16 cs.CV 新提交 77%

SpatialAvatar-0: High-Quality 4D Head Avatar with Multi-Stage Reconstruction

SpatialAvatar-0: 高质量4D头部虚拟形象的多阶段重建

Yiran Wang, Zeyu Zhang, Yuanming Li, Ziming Wang, Yang Zhao

机构 * USYD(悉尼大学) SpatialReal ZJU(浙江大学) La Trobe(拉筹伯大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出基于FLAME网格绑定高斯表示的多阶段框架,通过前馈生成器和10K迭代布局保持微调,实现跨域零样本和单目基准领先性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 7 篇

2606.16672 2026-06-16 cs.CV 新提交 79%

Sinkhorn-CPD: Robust point cloud registration via unbalanced entropic optimal transport

Sinkhorn-CPD:通过非平衡熵最优传输实现鲁棒点云配准

Jin Zhang, Mingyang Zhao, Bing Liu, Xin Jiang

机构 * LMIB & School of Mathematical Sciences, Beihang University(北京航空航天大学数学科学学院与LMIB) State Key Laboratory of Mathematical Sciences, Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院数学科学国家重点实验室) Beijing Key Laboratory of Artificial Intelligence Innovation and Application in the Machine Tool Industry, School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院北京市机床行业人工智能创新与应用重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出Sinkhorn-CPD,用双KL散度惩罚替代CPD的目标边际约束,通过非平衡熵最优传输和广义Sinkhorn迭代实现鲁棒点云配准,方差自动退火无需手动调参。

Comments 14 pages, 10 figures; journal version published in Computer-Aided Design

Journal ref Computer-Aided Design 199 (2026) 104104

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16593 2026-06-16 cs.CV 新提交 79%

Rotational Symmetry based Object Pose Estimation from Point Clouds in the Absence of Known 3D Models

基于旋转对称性的无已知3D模型点云物体姿态估计

Weichen Dai, Ruixun Yu, Yangjie Tang, Yifan Du, Yiyang Zhang, Donglei Sun, Hua Zhang

机构 * Key Laboratory of Brain Machine Collaborative Intelligence of Zhejiang Province, School of Computer Science, Hangzhou Dianzi University(浙江省脑机协同智能重点实验室,杭州电子科技大学计算机学院) Advanced Intelligent Manufacturing Research Group, the University of Nottingham Ningbo China(先进智能制造研究组,宁波诺丁汉大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出利用工业物体的旋转对称性,通过迭代优化联合估计姿态与点云,无需已知3D模型,在合成和真实数据集上达到与有模型方法相当的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16570 2026-06-16 cs.RO 新提交 79%

Automated Digital Twin Construction for Highway Scenarios Using LiDAR Point Clouds and OpenStreetMap

基于LiDAR点云和OpenStreetMap的高速公路场景自动数字孪生构建

Yongqi Zhao, Dong Bi, Paul Kovacevic, Tomislav Mihalj, Martin Schabauer, Johannes Betz, Arno Eichberger

机构 * Institute of Automotive Engineering, Graz University of Technology(格拉茨技术大学汽车工程研究所) School of Intelligent Connected Vehicle, Hubei University of Automotive Technology(湖北汽车工业学院智能网联汽车学院) Professorship of Autonomous Vehicle Systems, Technical University of Munich(慕尼黑工业大学自动驾驶系统教席)

专题命中 点云 :point cloud(title,abstract);分类 cs.RO

AI总结 提出融合LiDAR点云与OpenStreetMap数据的自动化流程,生成地理参考的ASAM OpenDRIVE高速公路地图,实现车道级几何与拓扑的完整建模,平均横向RMSE为0.740米。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14811 2026-06-16 cs.CV 新提交 70%

S23DR 2026: End-to-End 3D Wireframe Prediction via DETR-Style Set Prediction with Contrastive Denoising

S23DR 2026:基于对比去噪的DETR风格集合预测实现端到端3D线框预测

Nitiz Khanal

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 点云 :3D reconstruction(abstract);point cloud(abstract);分类 cs.CV

AI总结 提出WireframeDETR方法,直接对3D点云进行DETR风格集合预测,无需中间顶点检测,通过对比去噪训练、多尺度编码器和渐进辅助损失权重实现端到端3D线框预测,在S23DR 2026挑战赛上取得0.575 HSS。

Comments Technical report; S23DR 2026 Challenge submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16569 2026-06-16 cs.CV cs.RO 新提交 62%

PROSE: Training-Free Egocentric Scene Registration with Vision-Language Models

PROSE: 基于视觉语言模型的无训练自我中心场景配准

Zhiang Chen, Nahyuk Lee, Boyang Sun, Taein Kwon, Marc Pollefeys, Zuria Bauer, Sunghwan Hong

机构 * ETH Zurich(苏黎世联邦理工学院) VGG, University of Oxford(牛津大学VGG实验室) ETH AI Center(苏黎世联邦理工学院人工智能中心)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 提出PROSE方法,利用预训练视觉语言模型将RGB序列提升为对象级3D场景图,通过对象高度先验和相同/不同查询匹配实例,无需训练或深度传感器即可实现自我中心场景配准,在Aria基准上超越几何和场景图基线。

Comments Project page: https://rckola.github.io/prose/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15328 2026-06-16 cs.CV 新提交 57%

SGFormer++: Semantic Graph Transformer for Incremental 3D Scene Graph Generation

SGFormer++:用于增量式3D场景图生成的语义图Transformer

Mengshi Qi, Changsheng Lv, Zijian Fu, Xianlin Zhang, Huadong Ma

机构 * State Key Laboratory of Networking and Switching Technology, Beijing University of Posts and Telecommunications(北京邮电大学网络与交换技术国家重点实验室)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出SGFormer++,通过图嵌入层和语义注入层实现全局消息传递,并引入空间引导特征适配器和级联二值预测头解决增量场景图生成中的灾难性遗忘问题,在3DSSG基准上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15356 2026-06-16 physics.flu-dyn cs.LG 新提交 50%

ShipNet: A Geometric Deep Learning Surrogate for Real-Time Ship Hydrodynamics

ShipNet:一种用于实时船舶水动力学的几何深度学习代理模型

Kirsten Odendaal, George Drakoulas

机构 * Maritime Research Institute(海洋研究机构) Wageningen, Netherlands(荷兰瓦格宁根) Damen Research(达门研究) Gorinchem, Netherlands(荷兰戈林切姆)

专题命中 点云 :point cloud(abstract)

AI总结 提出ShipNet几何深度学习代理模型,直接从船体几何和速度预测压力分布与波浪场,在保留测试集上R²达0.98和0.91,推理速度比势流求解器快550倍以上。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. SLAM与定位 1 篇

2606.16881 2026-06-16 cs.RO 新提交 57%

SGM-SLAM: Scene Graph Matching for Data-Efficient Distributed SLAM

SGM-SLAM:面向数据高效的分布式SLAM的场景图匹配

Yewei Huang, Tixiao Shan, Abhinav Rajvanshi, Niluthpol Chowdhury Mithun, Yaxuan Li, Brendan Englot, Han-Pang Chiu

机构 * Dartmouth College(达特茅斯学院) SRI International(SRI国际) Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.RO

AI总结 提出一种基于场景图匹配的分布式SLAM框架,仅使用对象标签和质心进行匹配,通过多步数据交换与优化实现高效通信,在室内外环境中验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏