arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-03-30 至 2026-03-30 共收录 23 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 3 篇

2602.05321 2026-03-30 cs.CV 83%

Wid3R: Wide Field-of-View 3D Reconstruction via Camera Model Conditioning

Wid3R:通过相机模型条件化实现宽视角三维重建

Dongki Jung, Jaehoon Choi, Adil Qureshi, Somi Jeong, Dinesh Manocha, Suyong Yeon

机构 * University of Maryland, College Park(马里兰大学帕克分校) NAVER LABS

专题命中 三维重建 :3D reconstruction(title,abstract);NeRF(abstract);分类 cs.CV

AI总结 Wid3R是一种多视角视觉几何重建的前馈神经网络,支持宽视角相机模型。该方法通过球谐函数的射线表示和新型相机模型标记实现抗畸变重建,首次支持360影像的多帧前馈3D重建,提升性能达33.67%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26509 2026-03-30 cs.CV 57%

Conditional Diffusion for 3D CT Volume Reconstruction from 2D X-rays

基于条件扩散的3DCT体积重建从2DX光

Martin Rath, Morteza Ghahremani, Yitong Li, Ashkan Taghipour, Marcus Makowski, Christian Wachinger

机构 * Technical University of Munich (TUM)(慕尼黑工业大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) University of Western Australia (UWA)(西澳大利亚大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出AXON框架,通过多阶段扩散模型直接从真实X光重建高保真3DCT体积,采用粗到细策略和ControlNet优化,支持双平面X光输入并提升诊断分辨率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16816 2026-03-30 cs.CV cs.DL 57%

WildDepth: A Multimodal Dataset for 3D Wildlife Perception and Depth Estimation

WildDepth:用于野生动物感知和深度估计的多模态数据集

Muhammad Aamir, Naoya Muramatsu, Sangyun Shin, Matthew Wijers, Jia-Xing Zhong, Xinyu Hou, Amir Patel, Andrew Loveridge, Andrew Markham

机构 * University of Oxford(牛津大学) University of Cape Town(开普敦大学) University College London(伦敦大学学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出WildDepth数据集,通过同步RGB和LiDAR数据提升动物深度估计和3D重建性能,实验表明多模态数据使深度可靠性提升10%RMSE,3D重建精度提高12%。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 9 篇

2603.26638 2026-03-30 cs.CV cs.RO 84%

Drive-Through 3D Vehicle Exterior Reconstruction via Dynamic-Scene SfM and Distortion-Aware Gaussian Splatting

通过动态场景SfM和抗畸变高斯点绘制实现车辆外观三维重建

Nitin Kulkarni, Akhil Devarashetti, Charlie Cluss, Livio Forte, Philip Schneider, Chunming Qiao, Alina Vereshchaka

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 本文提出一种端到端管道,结合动态场景SfM和抗畸变高斯点绘制,解决动态场景中车辆外观重建的挑战,实现高质量3D模型。

Comments 8 pages, 7 figures, Submitted to IEEE IROS 2026 (under review)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26067 2026-03-30 cs.CV cs.AI 83%

R-PGA: Robust Physical Adversarial Camouflage Generation via Relightable 3D Gaussian Splatting

R-PGA:通过可重照明的3D高斯点散布实现鲁棒的物理对抗伪装生成

Tianrui Lou, Siyuan Liang, Jiawei Liang, Yuze Gao, Xiaochun Cao

机构 * School of Cyber Science and Technology, Shenzhen Campus, Sun Yat-sen University(中山大学深圳校区网络空间安全学院) School of Computing, National University of Singapore(新加坡国立大学计算机学院) School of Intelligent Systems Engineering, Shenzhen Campus, Sun Yat-sen University(中山大学深圳校区智能工程学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 本文提出R-PGA框架,通过可重照明的3D高斯点散布技术,解决自动驾驶系统中对抗性伪装生成的鲁棒性问题,提升复杂动态场景下的泛化能力。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16542 2026-03-30 cs.CV 83%

EOGS++: Earth Observation Gaussian Splatting with Internal Camera Refinement and Direct Panchromatic Rendering

EOGS++:带有内部相机细化和直接全色渲染的地球观测高斯散射

Pierrick Bournez, Luca Savant Aira, Thibaud Ehret, Gabriele Facciolo

机构 * Universite Paris-Saclay, CNRS, ENS Paris-Saclay, Centre Borelli(巴黎萨克雷大学,法国国家科学研究中心,巴黎萨克雷高等师范学校,博雷利中心) Politecnico di Torino(都灵理工大学) AMIAD, Pôle Recherche(AMIAD,研究部) Institut Universitaire de France(法兰西大学研究院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);NeRF(abstract);分类 cs.CV

AI总结 EOGS++在卫星影像中直接操作高分辨率全色数据,通过内部相机细化和优化流程提升重建质量和几何精度,实验表明其在重建质量和效率上优于原有方法和其他NeRF方法。

Comments 8 pages, ISPRS

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22225 2026-03-30 cs.CV cs.AI 83%

ExtrinSplat: Decoupling Geometry and Semantics for Open-Vocabulary Understanding in 3D Gaussian Splatting

ExtrinSplat:解耦几何与语义以实现3D高斯散射中的开放词汇理解

Jiayu Ding, Xinpeng Liu, Zhiyi Pan, Shiqiang Long, Ge Li

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology, Shenzhen Graduate School, Peking University(广东省超高清沉浸式媒体技术重点实验室,北京大学深圳研究生院) School of Computer Science and Technology, Tianjin University(天津大学计算机科学与技术学院) Guangdong Bohua UHD Innovation Center Co., Ltd.(广东博华超高清创新中心有限公司)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 ExtrinSplat通过解耦几何与语义,利用视觉语言模型生成轻量文本假设,提升3D高斯散射中开放词汇物体选择和语义分割的性能和效率。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24994 2026-03-30 cs.CV 79%

Relaxed Rigidity with Ray-based Grouping for Dynamic Gaussian Splatting

基于射线分组的放松刚性方法用于动态高斯点云渲染

Junoh Lee, Junmyeong Lee, Yeon-Ji Song, Inhwan Bae, Jisu Shin, Hae-Gon Jeon, Jin-Hwa Kim

机构 * GIST(光州科学技术院) Yonsei Univ.(延世大学) SNU(首尔大学) DGIST(大邱庆北科学技术院) NAVER AI Lab(NAVER AI实验室)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 本文提出基于射线分组的放松刚性方法,通过保持高斯点云在时间上的局部几何结构,提升动态3D场景重建的物理合理性与时间一致性。

Comments 24 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06909 2026-03-30 cs.CV 77%

Gaussian Mapping for Evolving Scenes

高斯映射用于动态场景

Vladimir Yugay, Thies Kersten, Luca Carlone, Theo Gevers, Martin R. Oswald, Lukas Schmid

机构 * University of Amsterdam(阿姆斯特丹大学) University of Technology Nuremberg(纽伦堡工业大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本文提出GaME方法,通过动态场景适应机制持续更新3DGS,结合新颖的关键帧管理机制,提升动态场景重建性能,在PSNR和L1深度误差上分别提升29.7%和3倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09962 2026-03-30 cs.RO 70%

VG-Mapping: Variation-aware Density Control for Online 3D Gaussian Mapping in Semi-static Scenes

VG-Mapping:面向半静态场景的变分感知密度控制在线3D高斯映射

Yicheng He, Jingwen Yu, Guangcheng Chen, Hong Zhang

机构 * Southern University of Science and Technology(南方科技大学) CKS Robotics Institute, Hong Kong University of Science and Technology(香港科技大学CKS机器人研究所)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.RO

AI总结 本文提出VG-Mapping,通过变分感知密度控制策略提升半静态场景在线3D高斯映射的更新效率与渲染质量,同时构建了包含合成与真实数据的RGB-D数据集。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26665 2026-03-30 cs.CV 57%

Detailed Geometry and Appearance from Opportunistic Motion

从偶然运动中获取详细的几何与外观

Ryosuke Hirai, Kohei Yamashita, Antoine Guédon, Ryo Kawahara, Vincent Lepetit, Ko Nishino

机构 * Graduate School of Informatics, Kyoto University(京都大学信息学研究生院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文提出利用物体偶然运动获取更多准确的3D几何与外观,通过联合姿态与形状优化和新型外观模型提升重建精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26181 2026-03-30 cs.CV 57%

GLINT: Modeling Scene-Scale Transparency via Gaussian Radiance Transport

GLINT:通过高斯辐射传输建模场景级透明度

Youngju Na, Jaeseong Yun, Soohyun Ryu, Hyunsu Kim, Sung-Eui Yoon, Suyong Yeon

机构 * KAIST(韩国科学技术院) NAVER LABS

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 GLINT通过显式分解的高斯表示建模场景级透明度,分离反射和透射辐射,利用几何分离线索和预训练视频照明模型提升透明场景重建性能。

Comments CVPR 2026, Project page: https://youngju-na.github.io/GLINT

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 7 篇

2603.26197 2026-03-30 cs.IT cs.CV math.IT 79%

SAFT: Sensitivity-Aware Filtering and Transmission for Adaptive 3D Point Cloud Communication over Wireless Channels

SAFT:面向无线信道的自适应3D点云通信中的灵敏度感知滤波与传输

Huda Adam Sirag Mekki, Hui Yuan, Mohanad M. G. Hassan, Zejia Chen, Guanghui Zhang

机构 * School of Control Science and Engineering, Shandong University(山东大学控制科学与工程学院) Key Laboratory of Machine Intelligence and System Control, Ministry of Education(教育部机器智能与系统控制重点实验室) School of Computer Science and Technology, Shandong University(山东大学计算机科学与技术学院)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出SAFT框架,通过点-BERT编码器、灵敏度引导的token过滤模块、量化块和SNR感知解码器,实现自适应3D点云通信,提升低SNR下的几何保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26183 2026-03-30 cs.CV 79%

DUGAE: Unified Geometry and Attribute Enhancement via Spatiotemporal Correlations for G-PCC Compressed Dynamic Point Clouds

DUGAE:通过时空相关性实现统一的几何和属性增强以G-PCC压缩动态点云

Pan Zhao, Hui Yuan, Chang Sun, Chongzhen Tian, Raouf Hamzaoui, Sam Kwong

机构 * School of Control Science and Engineering, Shandong University(山东大学控制科学与工程学院) Key Laboratory of Machine Intelligence and System Control, Ministry of Education(教育部机器智能与系统控制重点实验室) Department of Computing and Decision Science, Lingnan University(岭南大学计算与决策科学系)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 DUGAE通过利用点云序列中的时空相关性,提升G-PCC压缩动态点云的几何和属性增强效果,显著提升了GeS-TM v10的性能,实现了BD-PSNR增益和比特率降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10055 2026-03-30 cs.CV eess.IV 79%

Fourier Decomposition for Explicit Representation of 3D Point Cloud Attributes

用于3D点云属性显式表示的傅里叶分解

Donghyun Kim, Chanyoung Kim, Hyunah Ko, Seong Jae Hwang

机构 * Yonsei University(延世大学) Emory University(埃默里大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 本文提出一种利用3D傅里叶分解的点云编码方法,以分离颜色和几何特征,提升多点间关系的捕捉能力,在DensePoint数据集上实现分类、分割和风格迁移的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26263 2026-03-30 cs.CV cs.RO 62%

DRUM: Diffusion-based Raydrop-aware Unpaired Mapping for Sim2Real LiDAR Segmentation

DRUM:基于扩散的反射率感知无配对映射用于Sim2Real激光雷达分割

Tomoya Miyawaki, Kazuto Nakashima, Yumi Iwashita, Ryo Kurazume

机构 * Kyushu University(九州大学) Jet Propulsion Laboratory, California Institute of Technology(喷气推进实验室,加州理工学院)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 DRUM通过利用未标记真实数据预训练的扩散模型,结合反射强度和射线丢失噪声特性,提升Sim2Real激光雷达分割性能。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26412 2026-03-30 cs.RO 57%

Generalizable task-oriented object grasping through LLM-guided ontology and similarity-based planning

通过LLM引导的本体和基于相似性的规划实现通用任务导向物体抓取

Hao Chen, Takuya Kiyokawa, Weiwei Wan, Kensuke Harada

机构 * Graduate School of Engineering Science, The University of Osaka(大阪大学工学研究科)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出基于LLM的本体和相似性规划方法,解决任务导向抓取中部分识别和抓取区域选择的稳定性问题,提升抓取的通用性和鲁棒性。

Comments Accepted by Robotics and Autonomous Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26262 2026-03-30 cs.CV cs.LG 57%

GLASS: Geometry-aware Local Alignment and Structure Synchronization Network for 2D-3D Registration

GLASS:面向2D-3D配准的几何感知局部对齐与结构同步网络

Zhixin Cheng, Jiacheng Deng, Xinjun Li, Bohao Liao, Li Liu, Xiaotian Yin, Baoqun Yin, Tianzhu Zhang

机构 * School of Information Science and Technology, University of Science and Technology of China(中国科学技术大学信息科学技术学院) Institute of Advanced Technology, University of Science and Technology of China(中国科学技术大学先进技术研究院) Meituan Inc(美团)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出GLASS网络,通过局部几何增强和图分布一致性模块,解决重复模式下2D-3D配准中的结构不一致问题,提升匹配精度。

Comments Accepted by IEEE Transactions on Circuits and Systems for Video Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25993 2026-03-30 cs.CV 57%

FAST3DIS: Feed-forward Anchored Scene Transformer for 3D Instance Segmentation

FAST3DIS:用于3D实例分割的前馈锚定场景Transformer

Changyang Li, Xueqing Huang, Shin-Fang Chng, Huangying Zhan, Qingan Yan, Yi Xu

机构 * Goertek Alpha Labs(歌尔阿尔法实验室)

专题命中 点云 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出FAST3DIS,一种端到端的3D实例分割方法,通过前馈锚定场景Transformer避免后处理聚类,提升分割精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 新视角合成 1 篇

2511.20620 2026-03-30 cs.CV cs.RO 79%

Wanderland: Geometrically Grounded Simulation for Open-World Embodied AI

Wanderland: 为开放世界具身AI提供几何学基础的模拟

Xinhao Liu, Jiaqi Li, Youming Deng, Ruxin Chen, Yingjia Zhang, Yifei Ma, Li Guo, Yiming Li, Jing Zhang, Chen Feng

机构 * New York University(纽约大学) Cornell University(康奈尔大学)

专题命中 新视角合成 :3DGS(abstract);3D reconstruction(abstract);novel view synthesis(abstract);分类 cs.CV、cs.RO

AI总结 本文提出Wanderland框架,通过多传感器采集和高精度几何重建,解决开放世界具身AI中模拟与现实差距大的问题,并展示其在导航政策学习中的应用。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 3D生成 1 篇

2512.09435 2026-03-30 cs.CV 79%

UniPart: Part-Level 3D Generation with Unified 3D Geom-Seg Latents

UniPart: 部级3D生成与统一3D几何-分割潜在表示

Xufan He, Yushuang Wu, Xiaoyang Guo, Chongjie Ye, Jiaqing Zhou, Tianlei Hu, Xiaoguang Han, Dong Du

机构 * Nanjing University of Science and Technology(南京理工大学) ByteDance Games(字节跳动游戏) Zhejiang University(浙江大学) FNii-Shenzhen(深圳福田国家创新研究院) SSE, CUHKSZ(香港中文大学(深圳)理工学院) Guangdong Provincial Key Laboratory of Future Networks of Intelligence(广东省未来智能网络重点实验室)

专题命中 3D生成 :3D generation(title,abstract);分类 cs.CV

AI总结 本文提出UniPart,一种基于统一3D几何-分割潜在表示的两阶段扩散框架,实现图像引导的部级3D生成,提升分割可控性和几何质量。

Comments Project page: https://xfanhe.github.io/projects/unipart/

详情

展开后加载摘要…

URL PDF HTML 收藏

6. SLAM与定位 2 篇

2603.25819 2026-03-30 cs.CV 57%

Geo$^\textbf{2}$: Geometry-Guided Cross-view Geo-Localization and Image Synthesis

Geo²:基于几何的跨视角地理定位与图像合成

Yancheng Zhang, Xiaohan Zhang, Guangyu Sun, Zonglin Lyu, Safwan Wshah, Chen Chen

机构 * Institute of Artificial Intelligence, University of Central Florida(中佛罗里达大学人工智能研究所) University of Vermont(佛蒙特大学)

专题命中 SLAM与定位 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出Geo²框架,利用几何先验知识联合完成跨视角地理定位和双向图像合成,通过共享3D感知潜在空间和GeoFlow模型提升性能。

Journal ref 2026 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25799 2026-03-30 eess.SP 50%

Occlusion-Aware Multimodal Beam Prediction and Pose Estimation for mmWave V2I

面向毫米波V2I的遮挡感知多模态波束预测与姿态估计

Abidemi Orimogunje, Hyunwoo Park, Kyeong-Ju Cha, Igbafe Orikumhi, Sunwoo Kim, Dejan Vukobratovic

专题命中 SLAM与定位 :point cloud(abstract)

AI总结 本文提出一种受SLAM启发的多模态学习框架,用于动态遮挡下的毫米波V2I波束管理,通过融合RGB图像、LiDAR点云、雷达范围-角度图、GNSS和短时毫米波功率历史,实现波束索引、遮挡概率和2D位置的联合预测,验证了感知与通信结合在6G V2I系统中的价值。

Comments IEEE VTC

详情

展开后加载摘要…

URL PDF HTML 收藏