arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-05-27 至 2026-05-27 共收录 26 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 7 篇

2605.26230 2026-05-27 cs.CV 79%

Geometry-Aware Representation Denoising for Robust Multi-view 3D Reconstruction

几何感知表示去噪用于鲁棒的多视角3D重建

Jin Hyeon Kim, Jaeeun Lee, Claire Kim, Kyoungjin Oh, Paul Hyunbin Cho, Jaewon Min, Yeji Choi, Jihye Park, Hyunhee Park, Minkyu Park, Seungryong Kim

机构 * KAIST AI(韩国国立科学技术院人工智能研究所) Samsung Electronics(三星电子)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 提出几何感知表示去噪(GARD)框架,在前馈3D重建模型的特征空间中执行扩散式多视角恢复,同时恢复场景几何与高质量RGB图像,在DA3基准上验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07853 2026-05-27 cs.CV 79%

V2V3D: View-to-View Denoised 3D Reconstruction for Light-Field Microscopy

V2V3D:用于光场显微镜的视图到视图去噪三维重建

Jiayin Zhao, Zhenqi Fu, Tao Yu, Hui Qiao

机构 * Tsinghua University, Beijing 100084, China(清华大学,北京100084,中国) Shanghai AI Laboratory, China(上海人工智能实验室,中国)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 提出无监督视图到视图框架V2V3D,联合优化图像去噪和三维重建,利用噪声独立性实现噪声到噪声去噪,并设计基于波动光学的特征对齐技术恢复高频细节,在效率和性能上超越现有方法。

Comments CVPR 2025; New version: Fix NSFC ID

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26616 2026-05-27 cs.CV 77%

Gaussian-Voxel Duet: A Dual-Scaffolding Hybrid Representation for Fast and Accurate Monocular Surface Reconstruction

高斯-体素二重奏:用于快速准确单目表面重建的双支架混合表示

Zhenhua Du, Zhen Tan, Haoyu Zhang, Dewen Hu, Shuaifeng Zhi, Peidong Liu

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) National University of Defense Technology(国防科技大学)

专题命中 三维重建 :Gaussian Splatting(abstract);3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 提出一种混合高斯-体素表示,通过将锚定高斯约束在体素化SDF定义的表面窄带内,并引入隐式表面约束损失,在保持快速训练和实时渲染的同时,实现了高质量表面重建和新视图合成。

Comments 27 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26149 2026-05-27 cs.GR cs.CV 62%

AnySurf: Any Surface Generation with Directed Edge

AnySurf: 基于有向边的任意表面生成

Wenda Shi, Chenyuan Pan, Dengming Zhang, Yiren Song, Biao Zhang, Xingxing Zou

机构 * The Hong Kong Polytechnic University(香港理工大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) Xi'an Jiaotong University(西安交通大学)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV、cs.GR

AI总结 提出AnySurf统一框架,通过有向边增强的柔性双网格表示,实现开放、封闭和混合3D表面的高质量生成,并引入ROS-FT后训练和轻量级DE-Adapter以保持生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27372 2026-05-27 cs.CV 57%

G3T Up! Gravity Aligned Coordinate Frames Simplify Pointmap Processing

G3T 崛起!重力对齐的坐标框架简化点图处理

Bharath Raj Nagoor Kani, Noah Snavely

机构 * Cornell University(康奈尔大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出G3T模型,通过预测重力对齐的点图而非相机中心点图,利用场景结构先验减少旋转自由度,提升3D重建精度。

Comments Project Page: https://g3t-paper.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26103 2026-05-27 cs.CV 57%

Global Structure-from-Motion Meets Feedforward Reconstruction

全局运动恢复结构与前馈重建的结合

Linfei Pan, Johannes Schönberger, Marc Pollefeys

机构 * ETH Zurich(苏黎世联邦理工学院) Meta Reality Labs(Meta现实实验室) Microsoft(微软公司)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出一种结合经典SfM和前馈重建优势的新流水线,在多种场景下实现最先进的重建结果。

Comments CVPR 2026, Highlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26406 2026-05-27 cs.NI 50%

mmDiff: A Noise-Robust Differentiable Ray-Tracing Framework for mmWave Scene Calibration and Channel Prediction

mmDiff: 一种用于毫米波场景校准和信道预测的噪声鲁棒可微分光线追踪框架

Haofan Lu, Yadi Cao, Wanghao Yi, Omid Abari

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 针对重建模型几何噪声导致无线仿真不准确的问题,提出可微分方向散射模型近似镜面反射,实现噪声鲁棒的信道预测与材料校准。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 10 篇

2605.25029 2026-05-27 cs.RO 91%

ParkingWorld: End-to-End Autonomous Parking Reinforcement Learning from Corrective Experience in 3DGS Simulation

ParkingWorld: 基于3DGS仿真中纠正性经验的端到端自主泊车强化学习

Zhengcheng Yu, Changze Li, Haoran Liu, Tong Qin

机构 * Tsinghua University(清华大学) Shanghai Jiaotong University(上海交通大学)

专题命中 Gaussian Splatting :3DGS(title,title_cn);Gaussian Splatting(abstract);分类 cs.RO

AI总结 提出一种基于纠正性经验的样本高效强化学习框架(CIL-SERL),在逼真的3D高斯溅射(3DGS)仿真器中训练端到端自主泊车策略,通过多级回放缓冲区机制提高成功率、效率和安全性。

Comments 9 pages(including 1 page of Appendix), 6 figures. Will be submitted to RA-L 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12647 2026-05-27 cs.CV cs.AI 89%

LR-SGS: Robust LiDAR-Reflectance-Guided Salient Gaussian Splatting for Self-Driving Scene Reconstruction

LR-SGS:用于自动驾驶场景重建的鲁棒激光雷达反射率引导显著高斯泼溅

ZY Chen, F Zhu, H Zhu, DY Kong, XK Kuang, YJ Zhang, CM Jiang

机构 * Waymo Open Dataset(Waymo开放数据集)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);point cloud(abstract);novel view synthesis(abstract)

AI总结 提出一种结合激光雷达反射率与RGB的显著高斯表示方法,通过结构感知初始化、反射率校准和联合对齐,实现高效鲁棒的自动驾驶场景重建。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00648 2026-05-27 cs.CV 89%

DirectFisheye-GS: Enabling Native Fisheye Input in Gaussian Splatting with Cross-View Joint Optimization

DirectFisheye-GS: 在三维高斯泼溅中通过跨视图联合优化实现原生鱼眼输入

Zhengxian Yang, Fei Xie, Xutao Xue, Rui Zhang, Taicheng Huang, Yang Liu, Mengqi Ji, Tao Yu

机构 * BNRist, Tsinghua University(北京理工大学,清华大学) Beihang University(北航) JD.com, Beijing, China(京东(北京,中国)) Shanghai AI Lab(上海人工智能实验室)

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 针对鱼眼相机输入导致的信息丢失和细节模糊问题,提出将鱼眼相机模型集成到3DGS框架中,并引入基于特征重叠的跨视图联合优化策略,实现无需预处理的原生鱼眼图像训练,提升重建质量。

Comments CVPR 2026 Highlight; Fix NSFC ID

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26447 2026-05-27 cs.CV 87%

Underwater360: Reconstructing Underwater Scenes from Panoramic Images with Omnidirectional Gaussian Splatting

Underwater360: 基于全景高斯泼溅的全景图像水下场景重建

Jiangbei Hu, Weichao Song, Shibo Yu, Mohan Wang, Zihan Yi, Rui Wu, Mingkang Xiang, Na Lei, Shengfa Wang, Zhongxuan Luo, Ying He

机构 * School of Software, Dalian University of Technology(大连理工大学软件学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);novel view synthesis(abstract);分类 cs.CV

AI总结 提出Underwater360框架,利用物理信息引导的全向高斯泼溅,通过球面光线投射和外观-介质建模,实现水下全景场景的高质量重建与外观恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26576 2026-05-27 cs.CV cs.LG 85%

TrackRef3D: Multi-View Consistent Track-then-Label for Open-World Referring Segmentation in 3D Gaussian Splatting

TrackRef3D: 面向开放世界3D高斯泼溅分割的多视角一致跟踪-标注方法

Yuyang Tan, Renhe Zhang, Hang Zhang, Ao Li, Xin Tan

机构 * East China Normal University, Shanghai, China(华东师范大学,上海,中国) Shanghai AI Laboratory(上海人工智能实验室) University of Electronic Science and Technology of China, Chengdu, China(电子科技大学,成都,中国)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 提出TrackRef3D全自动流水线,通过多视角一致跟踪-标注范式解耦目标发现与语义定位,无需人工标注实现开放世界3D高斯泼溅分割。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26880 2026-05-27 eess.IV cs.MM 85%

GScomp-QA: A Subjective Dataset for Quality Assessment of Compressed Gaussian Splatting

GScomp-QA:压缩高斯泼溅质量评估的主观数据集

Pedro Martin, António Rodrigues, João Ascenso, Maria Paula Queluz

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3D reconstruction(abstract);novel view synthesis(abstract)

AI总结 针对高斯泼溅压缩缺乏评估数据集的问题,构建了包含331个视频刺激的主观质量评估数据集GScomp-QA,并通过率失真分析和18种客观指标评估现有压缩方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26629 2026-05-27 cs.CV 83%

DelowlightSplat: Feed-Forward Gaussian Splatting for Lowlight 3D Scene Reconstruction

DelowlightSplat: 面向低光照3D场景重建的前馈高斯泼溅

Fuzhen Jiang, Zengtian Xie, Zhuoran Li

机构 * Hangzhou Dianzi University(杭州电子科技大学) Zhuhai College of Science(珠海科技学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 提出DelowlightSplat,一种低光照感知的前馈高斯泼溅框架,通过轻量级低光照适配器和成本体积多视图推理,从稀疏有噪声图像中直接预测干净3D高斯,实现高质量新视角合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15283 2026-05-27 cs.CV cs.GR 62%

LuxRemix: Lighting Decomposition and Remixing for Indoor Scenes

LuxRemix: 室内场景的光照分解与重新混合

Ruofan Liang, Norman Müller, Ethan Weber, Duncan Zauss, Nandita Vijaykumar, Peter Kontschieder, Christian Richardt

机构 * Meta Reality Labs(Meta现实实验室) University of Toronto(多伦多大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 提出一种基于图像的光照分解模型,从多视图场景捕获中分解室内光照为独立光源,并通过多视图光照协调集成到可重光照的3D高斯溅射表示中,实现交互式光源编辑。

Comments CVPR 2026. Project page: https://luxremix.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26500 2026-05-27 cs.CV 57%

3D Gaussian Map with Open-Set Semantic Grouping for Vision-Language Navigation

面向视觉-语言导航的开放集语义分组3D高斯地图

Jianzhe Gao, Rui Liu, Wenguan Wang

机构 * The State Key Lab of Brain-Machine Intelligence(脑机智能国家重点实验室)

专题命中 Gaussian Splatting :point cloud(abstract);分类 cs.CV

AI总结 提出一种3D高斯地图表示环境,通过在线构建自中心场景地图和开放集语义分组操作增强几何与语义信息,并设计多层级动作预测策略,在三个公开基准上验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18866 2026-05-27 cs.LG cs.AI 50%

FLUIDSPLAT: Reconstructing Physical Fields from Sparse Sensors via Gaussian Primitives

FLUIDSPLAT: 通过高斯原语从稀疏传感器重建物理场

Huaxi Huang, Meng Li, Zhengqing Gao, Xi Zhou, Xiaoshui Huang, Xiao Sun

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The Hong Kong University of Science and Technology(香港科学与技术大学) Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学) Shanghai Jiaotong University(上海交通大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract)

AI总结 提出FLUIDSPLAT模型,利用高斯原语作为空间显式中间表示,从稀疏传感器数据重建流场,理论分析了表示能力与观测数的关系,并在多个基准上实现误差降低11-28%。

Comments 24 pages, 5 figures,preprint

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 6 篇

2605.26894 2026-05-27 cs.CV 79%

SIMPC: Learning Self-Induced Mirror-Point Consistency for Unsupervised Point Cloud Denoising

SIMPC: 学习自诱导镜像点一致性用于无监督点云去噪

Chengwei Zhang, Xueyi Zhang, Tao Jiang, Xinhao Xu, Wenjie Li, Fubo Zhang, Longyong Chen

机构 * National Key Laboratory of Microwave Imaging, Aerospace Information Research Institute, Chinese Academy of Sciences, Beijing, China(微波成像国家重点实验室,航天信息研究所,中国科学院,北京,中国) School of Computing, National University of Singapore, Singapore(计算学院,新加坡国立大学,新加坡)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出自诱导镜像点一致性(SIMPC)方法,通过几何先验生成镜像点并约束去噪目标一致性,实现无监督点云去噪,在合成和真实数据集上超越现有无监督及部分有监督方法。

Comments Accepted by ICML 2026. 17 pages, 8 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08375 2026-05-27 cs.CV 79%

Source-Free Domain Adaptation for Geospatial Point Cloud Semantic Segmentation

地理空间点云语义分割的无源域适应

Yuan Gao, Di Cao, Xiaohuan Xi, Sheng Nie, Shaobo Xia, Cheng Wang

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航天信息研究所) International Research Center of Big Data for Sustainable Development Goals(可持续发展目标大数据国际研究中心) University of Chinese Academy of Sciences(中国科学院大学) Zhengzhou Institute for Advanced Research of Henan Polytechnic University(河南理工大学郑州研究院) Henan Polytechnic University(河南理工大学) School of Aeronautic Engineering, Changsha University of Science and Technology(长沙理工大学航空工程学院) China University of Geosciences, Beijing(中国地质大学(北京))

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出LoGo无源域适应框架,通过局部类平衡原型估计和全局最优传输分布对齐,解决地理空间点云语义分割中的域偏移问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27178 2026-05-27 cs.CV cs.AI cs.LG cs.RO 62%

FoundObj: Self-supervised Foundation Models as Rewards for Label-free 3D Object Segmentation

FoundObj: 自监督基础模型作为无标签3D物体分割的奖励

Zihui Zhang, Zhixuan Sun, Yafei Yang, Jinxi Li, Jiahao Chen, Bo Yang

机构 * Shenzhen Research Institute, The Hong Kong Polytechnic University(深圳研究院,香港理工大学) vLAR Group, The Hong Kong Polytechnic University(vLAR小组,香港理工大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 提出FoundObj框架,利用自监督2D/3D基础模型的语义和几何先验作为奖励,通过强化学习引导超点合并,实现无标注复杂场景3D物体分割。

Comments ICML 2026. Zihui and Zhixuan are co-first authors. Code and data are available at: https://github.com/vLAR-group/FoundObj

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26316 2026-05-27 cs.CV cs.AI 57%

E$^3$C: Video Generation with 3D Environmental Memory and Ego-Exo Human Pose Control

E$^3$C: 具有3D环境记忆和自我-外部人体姿态控制的视频生成

Qiao Gu, Lingni Ma, Adam W Harley, Richard Newcombe, Florian Shkurti, Julian Straub

机构 * Meta Reality Labs(Meta现实实验室) University of Toronto(多伦多大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出E$^3$C可控视频扩散框架,通过3D点云记忆和双通道人体控制(自我与外骨骼),实现物理一致的自我中心视频生成。

Comments Preprint. Project Page: https://e3c-videogen.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19741 2026-05-27 cs.CV 57%

Efficient Transferable Optimal Transport via Min-Sliced Transport Plans

通过最小切片传输计划的高效可迁移最优传输

Xinran Liu, Elaheh Akbari, Rocio Diaz Martin, Navid NaderiAlizadeh, Soheil Kolouri

机构 * Department of Computer Science, Vanderbilt University(范德比大学计算机科学系) Department of Mathematics, Florida State University(佛罗里达州立大学数学系) Department of Biostatistics & Bioinformatics, Duke University(杜克大学生物统计学与生物信息学系) Department of Electrical & Computer Engineering, Vanderbilt University(范德比大学电气与计算机工程系)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出最小切片传输计划(min-STP)框架,研究优化切片器在不同分布对间的可迁移性,并引入小批量公式以提高可扩展性,在点云对齐和流生成建模中实现一次性匹配和摊销训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19206 2026-05-27 cs.CV 57%

GS-CLIP: Zero-shot 3D Anomaly Detection by Geometry-Aware Prompt and Synergistic View Representation Learning

GS-CLIP: 基于几何感知提示与协同视图表示学习的零样本3D异常检测

Zehao Deng, An Liu, Yan Wang

机构 * School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出GS-CLIP框架,通过几何感知提示和协同视图表示学习,在零样本设置下有效检测3D点云中的几何异常。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 新视角合成 1 篇

2605.26328 2026-05-27 cs.CV 57%

RadarSim: Simulating Single-Chip Radar via Multimodal Neural Fields

RadarSim: 通过多模态神经场模拟单芯片雷达

Chuhan Chen, Tianshu Huang, Akarsh Prabhakara, Chaithanya Kumar Mummadi, Zhongxiao Cong, Anthony Rowe, Matthew O'Toole, Deva Ramanan

机构 * Carnegie Mellon University(卡内基梅隆大学) Bosch Research(博世研究) University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 提出RadarSim,一种利用RGB相机高角分辨率从相机初始化的神经场生成多普勒雷达距离图像的统一可微渲染器,以解决雷达空间分辨率低的问题,并产生比纯雷达重建更清晰的几何和多普勒距离帧。

Comments Accepted to 3DV 2026. Project website: https://sally-chen.github.io/radar-sim/

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 3D生成 1 篇

2605.26137 2026-05-27 cs.GR cs.AI cs.CV 62%

AssetGen: Deployable 3D Asset Generation at Interactive Speed

AssetGen: 可部署的交互速度3D资产生成

Dilin Wang, Xiaoyu Xiang, Kihyuk Sohn, Tom Monnier, Yu-Ying Yeh, Thu Nguyen-Phuoc, Jiawen Zhang, Yuchen Fan, Antoine Toisoul, Hyunyoung Jung, Prithviraj Dhar, Michael Bunnell, Nikolaos Sarafianos, Chuhang Zou, Roman Shapovalov, Andrea Vedaldi, Rakesh Ranjan

机构 * Reality Labs, Meta(Meta现实实验室)

专题命中 3D生成 :3D generation(abstract);分类 cs.CV、cs.GR

AI总结 提出AssetGen系统,通过粗到细的VecSet框架、多视图纹理生成及端到端加速,在30秒内生成带烘焙法线、颜色纹理和可控多边形预算的高质量网格,支持实时渲染和移动端部署。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 空间理解 1 篇

2601.12809 2026-05-27 cs.CV cs.AI cs.LG 57%

Left-Right Symmetry Breaking in CLIP-style Vision-Language Models Trained on Synthetic Spatial-Relation Data

CLIP风格视觉语言模型在合成空间关系数据训练中的左右对称性破缺

Takaki Yamamoto, Chihiro Noguchi, Toshihiro Tanizawa

机构 * InfoTech, Toyota Motor Corporation(丰田汽车公司信息科技部门)

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV

AI总结 通过可控一维图像文本测试平台,研究基于Transformer的视觉语言编码器在CLIP风格对比学习下如何通过位置与标记嵌入交互产生左右关系理解,并发现标签多样性比布局多样性更关键。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏