arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-05-18 至 2026-05-18 共收录 22 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 3 篇

2508.01014 2026-05-18 cs.RO cs.CV 84%

Hestia: Voxel-Face-Aware Hierarchical Next-Best-View Acquisition for Efficient 3D Reconstruction

Hestia:面向高效3D重建的体素-面感知分层最佳视角获取

Cheng-You Lu, Zhuoli Zhuang, Nguyen Thanh Trung Le, Da Xiao, Yu-Cheng Chang, Thomas Do, Srinath Sridhar, Chin-teng Lin

机构 * University of Technology Sydney(悉尼技术大学) Brown University(布朗大学)

专题命中 三维重建 :3D reconstruction(title,abstract);novel view synthesis(abstract);分类 cs.CV、cs.RO

AI总结 本文提出Hestia,一种面向高效3D重建的体素-面感知分层最佳视角获取方法,通过改进的规划器组件提升鲁棒性和性能,实验显示在覆盖比和Chamfer距离上均有显著提升。

Comments Accepted to the IEEE/CVF Winter Conference on Applications of Computer Vision (WACV) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15369 2026-05-18 cs.GR 57%

OffsetAxis: UDF Mesh Reconstruction via Offset-Volume Medial Axis Extraction

OffsetAxis:通过偏移体积医学轴提取实现UDF网格重建

Qijia Huang, Pierre Kraemer, Dominique Bechmann

专题命中 三维重建 :point cloud(abstract);分类 cs.GR

AI总结 本文提出OffsetAxis方法,通过偏移体积医学轴提取实现UDF网格重建,支持开放、非 manifold 和曲线状几何,采用变分医学轴采样优化,生成结构一致的网格。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01852 2026-05-18 cs.CV 57%

DP-SfM: Dual-Pixel Structure-from-Motion without Scale Ambiguity

DP-SfM:无尺度模糊的双像素结构从运动

Lilika Makabe, Kohei Ashida, Hiroaki Santo, Fumio Okura, Yasuyuki Matsushita

机构 * Graduate School of Information Science and Technology, The University of Osaka(信息科学与技术研究生院,大阪大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出DP-SfM方法,利用双像素传感器的模糊特性自动解决尺度模糊问题,无需参考物体或先验校准,通过深度图与模糊核优化实现绝对尺度估计。

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 9 篇

2605.15760 2026-05-18 cs.CV 90%

Learn2Splat: Extending the Horizon of Learned 3DGS Optimization

Learn2Splat: 扩展学得3DGS优化的视野

Naama Pearl, Stefano Esposito, Haofei Xu, Amit Peleg, Patricia Gschossmann, Lorenzo Porzi, Peter Kontschieder, Gerard Pons-Moll, Andreas Geiger

机构 * University of Tübingen, Tübingen AI Center(图宾根大学,图宾根人工智能中心) ETH Zurich(苏黎世联邦理工学院) Meta Reality Labs(Meta现实实验室)

专题命中 Gaussian Splatting :3DGS(title,title_cn);Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本文提出了一种学得优化器,通过元学习方案扩展优化视野,提升稀疏和密集视角下的重建质量与稳定性,实现零样本泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15324 2026-05-18 eess.SP 87%

Eff-WRFGS: Efficient Wireless Radiance Field Using 3D Gaussian Splatting

Eff-WRFGS:基于3D高斯点划的高效无线辐射场

Chenghong Bian, Meng Hua, Deniz Gunduz

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);NeRF(abstract,abstract_cn);point cloud(abstract)

AI总结 本文提出Eff-WRFGS框架,利用3D高斯点划建模无线信道,通过可学习掩码优化高斯体重要性,实现存储减少和渲染加速。

Comments 5 pages, for possible IEEE journal publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.28111 2026-05-18 cs.RO 85%

GSDrive: Reinforcing Driving Policies by Multi-mode Future Trajectory Probing with 3D Gaussian Splatting Environment

GSDrive: 通过多模式未来轨迹探查与3D高斯点散布环境强化驾驶策略

Ziang Guo, Chen Min, Xuefeng Zhang, Yixiao Zhou, Shuo Wang, Sifa Zheng, Dzmitry Tsetserukou, Zufeng Zhang

机构 * Intelligent Space Robotics Laboratory, Skolkovo Institute of Science and Technology(斯克尔科维科学与技术研究院智能空间机器人实验室) Research Center for Intelligent Computing Systems, SKLP, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所智能计算系统研究中心,SKLP) Department of Electrical and Electronic Engineering, The University of Hong Kong, China(香港大学电子与电气工程系) SuZhou Automotive Research Institute, Tsinghua University(清华大学苏州汽车研究院) School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动系统学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.RO

AI总结 GSDrive通过多模式轨迹探查和3D高斯点散布环境,结合模仿学习与强化学习,提升端到端自动驾驶的训练效果与鲁棒性。

Comments 2nd version

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13073 2026-05-18 cs.CV 85%

HarmoGS: Robust 3D Gaussian Splatting in the Wild via Conflict-Aware Gradient Harmonization

HarmoGS:通过冲突感知梯度和谐化实现野外鲁棒的3D高斯点云

Yulei Kang, Tianze Zhu, Jian-Fang Hu, Jianhuang Lai, Wei-Shi Zheng

机构 * Sun Yat-sen University(中山大学) Northeastern University(东北大学) Guangdong Province Key Laboratory of Information Security Technology(广东省信息安全技术重点实验室) Key Laboratory of Machine Intelligence and Advanced Computing, Ministry of Education, China(教育部机器智能与先进计算重点实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.CV

AI总结 本文提出HarmoGS框架,通过图像空间监督和梯度优化解决野外3D高斯点云中瞬时干扰和光照导致的跨视图不一致问题,提升重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15010 2026-05-18 cs.CV 81%

3D Skew-Normal Splatting

三维斜正态散射

Xiangru Wu, Ke Fan, Yanwei Fu

机构 * Fudan University(复旦大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本文提出Skew-Normal Splatting,通过引入可学习的斜度参数,实现对称高斯与半高斯形状的连续插值,提升边界和内部区域的建模灵活性,并改进训练稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16158 2026-05-18 cs.GR 79%

Smart target point control for Gaussian Splatting methods

智能目标点控制用于高斯溅射方法

Pratik Singh Bisht, Andreas Kolb

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.GR

AI总结 本文提出一种智能目标点控制方案,通过调整高斯溅射的参数以跟踪二次目标计数轨迹,确保所有方法和视图获得相等的密集化和修剪周期,实现更公平的评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16065 2026-05-18 cs.CV cs.AI 79%

Robust Prior-Guided Segmentation for Editable 3D Gaussian Splatting

鲁棒的先验引导分割用于可编辑的3D高斯散射

Raushan Joshi, Jean-Yves Guillemaut

机构 * University of Surrey(萨里大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 本文提出利用SAM-HQ生成准确2D掩码,通过先验引导标签重新分配实现鲁棒的3D分割,提升编辑任务的精度和效率。

Comments Accepted at IEEE International Conference on Image Processing 2026, 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16022 2026-05-18 cs.CV 79%

EndoGSim: Physics-Aware 4D Dynamic Endoscopic Scene Simulations via MLLM-Guided Gaussian Splatting

EndoGSim: 基于多模态大语言模型的物理感知4D动态内窥镜场景模拟

Changjing Liu, Yiming Huang, Long Bai, Beilei Cui, Hongliang Ren

机构 * Department of Electronic Engineering, The Chinese University of Hong Kong (CUHK)(香港中文大学电子工程系)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 本文提出EndoGSim框架,通过MLLM引导的高斯点散布实现内窥镜场景的物理感知重建与模拟,结合预训练分割和深度估计,提升手术模拟的真实性和准确性。

Comments Early Accepted by MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15398 2026-05-18 cs.GR cs.CV 79%

3DEditSafe: Defending 3D Editing Pipelines from Unsafe Generation

3DEditSafe: 防御3D编辑流程中的不安全生成

Nicole Meng, Zheyuan Liu, Meng Jiang, Yingjie Lao

机构 * Tufts University(塔夫茨大学) University of Notre Dame(诺特大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 本文提出3DEditSafe框架,通过安全正则化约束不安全语义传播,减少3D编辑中的不安全内容生成,揭示安全与质量的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 7 篇

2605.15923 2026-05-18 cs.CV 79%

Invaria: Learning Scale and Density Invariance in Point Clouds via Next-Resolution Prediction

Invaria:通过下一分辨率预测实现点云中的尺度和密度不变性

Chun-Peng Chang, Shaoxiang Wang, Alain Pagani, Dariu Gavrila, Holger Caesar

机构 * TU Delft(代尔夫特理工大学) DFKI(德累斯顿德国研究院)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出Invaria,一种通过下一分辨率预测和感受野校准实现点云尺度和密度不变性的编码器,提升了模型在不同分辨率下的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15546 2026-05-18 cs.CV 79%

3DTMDet: A Dual-Path Synergy Network of Transformer and SSM for 3D Object Detection in Point Clouds

3DTMDet:一种结合Transformer和SSM的双路径协同网络用于点云中的3D目标检测

Bingwen Qiu, Yuan Liu, Junqi Bai, Tong Jiang, Ben Liang, Fangzhou Chen, Xiubao Sui, Qian Chen

机构 * School of Electronic and Optical Engineering(电子与光学工程学院) The 28th Research Institute of China Electronics Technology Group Corporation(中国电子科技集团第二十八研究所) College of Astronautics(航天学院) School of Information and Communication Engineering(信息与通信工程学院) State key Laboratory of Extreme Environment Optoelectronic Dynamic Measurement Technology and Instrument(极端环境光电动态测量技术与仪器国家重点实验室)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出3DTMDet网络,结合SSM和Transformer,解决点云检测中稀疏点与远距离上下文理解的矛盾,通过3D混合Mamba Transformer模块和体素生成模块提升检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15475 2026-05-18 cs.CV cs.MM 79%

A Unified Non-Parametric and Interpretable Point Cloud Analysis via t-FCW Graph Representation

通过t-FCW图表示实现统一的非参数化且可解释的点云分析

Haijian Lai, Bowen Liu, Man Xu, Chan-Tong Lam, João Macedo, Benjamin Ng, Sio-Kei Im

机构 * Faculty of Applied Sciences, Macao Polytechnic University(澳门理工大学应用科学学院) University of Coimbra, CISUC/LASI, DEI(科英布拉大学) Macao Polytechnic University(澳门理工大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出增强型t-FCW图表示用于点云嵌入,分析其有效性来源并设计网络,实现高效可解释的点云处理,适用于分类和分割任务。

Comments Accepted for publication in IEEE Transactions on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15597 2026-05-18 cs.CV cs.GR cs.LG cs.RO 67%

CM-EVS: Sparse Panoramic RGB-D-Pose Data for Complete Scene Coverage

CM-EVS:稀疏全景RGB-D-姿态数据用于完整场景覆盖

Jiale Liu, Jungang Li, Jieming Yu, Xinglin Yu, Zihao Dongfang, Zongjian Ding, Kaifeng Ding, Yi Yang, Lidong Chen, Yang Zou, Shunwen Bai, Jiahuan Zhang, Haoran Huang, Shan Huang, Yudong Gao, Mingjun Cheng

机构 * Zhejiang University(浙江大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The Hong Kong University of Science and Technology(香港科学与技术大学) Vorynel(沃伊内尔) Xinjiang University(新疆大学) Wuhan Polytechnic University(武汉职业技术学院) Tianjin University(天津大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.GR、cs.RO

AI总结 本文提出CM-EVS,通过COVER算法生成稀疏全景RGB-D-姿态数据,实现低冗余且可追溯的完整场景覆盖,提升3D学习的几何一致性。

Comments 35 pages including appendix. Code and dataset: https://github.com/Strange-animalss/CM-EVS

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15782 2026-05-18 cs.RO cs.SY eess.SY 57%

Reactive Robot-Centric Safety for Autonomous Navigation in Constrained and Dynamic Environments

反应式机器人中心安全机制用于受约束和动态环境中的自主导航

Viswa Narayanan Sankaranarayanan, Vignesh K. Viswanathan, Akshit Saradagi, Sumeet Satpute, George Nikolakopoulos

机构 * Department of Computer Science, Electrical and Space Engineering(计算机科学与电气与空间工程系)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出一种基于3D激光雷达感知的复合控制屏障函数安全过滤器,用于实时保障自主机器人在受限动态环境中的安全导航,通过现场实验验证其在复杂环境下的可靠性。

Comments 9 pages, 12 figures, currently under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00678 2026-05-18 cs.CV 57%

Pixel-to-4D: Camera-Controlled Image-to-Video Generation with Dynamic 3D Gaussians

像素到4D:通过动态3D高斯进行相机控制的图像到视频生成

Melonie de Almeida, Daniela Ivanova, Tong Shi, John H. Williamson, Paul Henderson

机构 * University of Glasgow(格拉斯哥大学)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出一种基于动态3D高斯的图像到视频生成框架,通过单次前向传递构建3D场景表示并采样合理物体运动,实现高效且可控的视频生成,实验表明其在多个数据集上均达到SOTA视频质量和推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15524 2026-05-18 cs.LG cs.AI math.DG math.ST stat.TH 50%

Neural Point-Forms

神经点形

Bruno Trentini, Jacob Hume, Vincenzo Antonio Isoldi, Philipp Misof, Ekaterina S. Ivshina, Kelly Maggs

机构 * NVIDIA University of Oxford(牛津大学) Max Planck Institute for Mathematics in the Sciences(马克斯·普朗克数学研究所) Department of Mathematical Sciences(数学科学系) Chalmers University of Technology and University of Gothenburg(查尔姆斯理工大学和哥德堡大学) School of Engineering and Applied Sciences(工程与应用科学学院) Max Planck Institute of Molecular Cell Biology and Genetics(马克斯·普朗克分子细胞生物学与遗传学研究所)

专题命中 点云 :point cloud(abstract)

AI总结 本文提出神经点形(NPFs),通过扩散几何中的拉普拉斯技术,构建点云的可学习几何特征,用于比较微分形式,并在合成和生物相关实验中展示其在处理采样密度、流形结构和群体几何时的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 3D生成 1 篇

2601.21798 2026-05-18 cs.CV 57%

CG-MLLM: Captioning and Generating 3D content via Multi-modal Large Language Models

CG-MLLM:通过多模态大语言模型实现图像描述与3D内容生成

Junming Huang, Chi Wang, Letian Li, Guangkai Xu, Donglin Huang, Hao Chen, Qiang Dai, Weiwei Xu

机构 * Zhejiang University, China(浙江大学)

专题命中 3D生成 :3D generation(abstract);分类 cs.CV

AI总结 本文提出CG-MLLM,一种能实现3D描述和高分辨率3D生成的多模态大语言模型,通过混合Transformer架构分离不同建模需求,结合预训练视觉语言模型与专用3D VAE潜在空间,提升3D生成质量与感知能力。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 空间理解 1 篇

2605.15391 2026-05-18 cs.CV cs.AI 57%

PanoWorld: Geometry-Consistent Panoramic Video World Modeling

PanoWorld:几何一致的全景视频世界建模

Le Jiang, Xiangyu Bai, Bishoy Galoaa, Shayda Moezzi, Caleb James Lee, Tooba Imtiaz, Edmund Yeh, Jennifer Dy, Yanzhi Wang, Sarah Ostadabbas

机构 * Northeastern University(东北大学)

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV

AI总结 PanoWorld通过几何和动态一致性建模生成一致的360度视频,提升了空间理解能力,适用于具身AI应用。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. SLAM与定位 1 篇

2602.20630 2026-05-18 cs.CV 70%

From Pairs to Sequences: Track-Aware Policy Gradients for Keypoint Detection

从配对到序列:面向跟踪的策略梯度方法用于关键点检测

Yepeng Liu, Hao Li, Liwen Yang, Fangzhen Li, Xudi Ge, Yuliang Gu, kuang Gao, Bing Wang, Guang Chen, Hangjun Ye, Yongchao Xu

机构 * School of Computer Science, Wuhan University(1 武汉大学计算机学院) Xiaomi EV(2 小米电动车)

专题命中 SLAM与定位 :3D vision(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出TraqPoint方法,将关键点检测视为序列决策问题,通过跟踪感知奖励机制提升关键点的长期可跟踪性,在稀疏匹配基准上优于现有方法。

Comments Accepted by CVPR 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏