arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-03-13 至 2026-03-13 共收录 21 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 3 篇

2603.11810 2026-03-13 cs.CV 74%

CEI-3D: Collaborative Explicit-Implicit 3D Reconstruction for Realistic and Fine-Grained Object Editing

CEI-3D: 基于协作显式-隐式方法的3D重建用于逼真且细粒度的对象编辑

Yue Shi, Rui Shi, Yuxuan Xiong, Bingbing Ni, Wenjun Zhang

机构 * School of Electronics, Information and Electrical Engineering(电子信息与电气工程学院)

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV

AI总结 CEI-3D通过协作显式-隐式重建方法,实现逼真且细粒度的对象编辑,采用解耦属性模块和空间感知编辑策略,提升编辑效果与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07504 2026-03-13 cs.CV 57%

High-Fidelity Medical Shape Generation via Skeletal Latent Diffusion

通过骨骼潜在扩散实现高保真的医学形状生成

Guoqing Zhang, Jingyun Yang, Siqi Chen, Anping Zhang, Yang Li

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出了一种骨骼潜在扩散框架,通过结合结构先验实现高效高保真医学形状生成,并构建了大规模MedSDF数据集以提升生成质量与效率。

Comments 11 pages, 5 figures, journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11623 2026-03-13 cs.AI 50%

The Density of Cross-Persistence Diagrams and Its Applications

交叉持续图的密度及其应用

Alexander Mironenko, Evgeny. Burnaev, Serguei Barannikov

机构 * Skolkovo Institute of Science and Technology(斯克罗夫诺研究所) AIRI CNRS, IMJ, Paris University(法国国家科学研究中心、巴黎大学IMJ)

专题命中 三维重建 :point cloud(abstract)

AI总结 本文首次系统研究了交叉持续图的密度,提出了一种基于点云坐标和距离矩阵的机器学习框架,通过利用交叉持续图的线性特性区分不同流形采样的点云,并发现引入噪声可增强区分能力。

Comments 19 pages, 20 figures

Journal ref in IEEE Access, vol. 14, pp. 34320-34338, 2026,

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 1 篇

2512.21692 2026-03-13 cs.CV cs.GR 62%

ShinyNeRF: Digitizing Anisotropic Appearance in Neural Radiance Fields

ShinyNeRF:神经辐射场中各向异性外观的数字化

Albert Barreiro, Roger Marí, Rafael Redondo, Gloria Haro, Carles Bosch

专题命中 NeRF :NeRF(abstract);分类 cs.CV、cs.GR

AI总结 ShinyNeRF 通过联合估计表面法线、切线、镜面浓度和各向异性程度,实现了对各向异性镜面反射的高效数字化,同时提供了物理可解释的材料属性编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 5 篇

2603.11531 2026-03-13 cs.CV 83%

Mobile-GS: Real-time Gaussian Splatting for Mobile Devices

Mobile-GS: 为移动设备实现实时高斯点云分裂

Xiaobiao Du, Yida Wang, Kun Zhan, Xin Yu

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV

AI总结 Mobile-GS通过深度感知无序渲染和神经视图依赖增强策略,实现在移动设备上的高效实时高斯点云分裂,同时减少计算和存储需求,保持高质量渲染。

Comments Project Page: https://xiaobiaodu.github.io/mobile-gs-project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08575 2026-03-13 cs.CV 79%

ReSplat: Learning Recurrent Gaussian Splatting

ReSplat: 学习递归高斯点散射

Haofei Xu, Daniel Barath, Andreas Geiger, Marc Pollefeys

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 ReSplat通过递归高斯点散射方法,利用渲染误差反馈信号实现高效3D重建,减少高斯点数量并提升渲染速度,取得最佳性能。

Comments Project page: https://haofeixu.github.io/resplat/ Code: https://github.com/cvg/resplat

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11543 2026-03-13 cs.CV 79%

Mango-GS: Enhancing Spatio-Temporal Consistency in Dynamic Scenes Reconstruction using Multi-Frame Node-Guided 4D Gaussian Splatting

Mango-GS: 通过多帧节点引导的4D高斯散射提升动态场景重建的空间-时间一致性

Tingxuan Huang, Haowei Zhu, Jun-hai Yong, Hao Pan, Bin Wang

机构 * School of Software, Tsinghua University(清华大学软件学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 Mango-GS通过多帧节点引导的4D高斯散射方法,提升动态场景重建的空间-时间一致性,实现高保真重建与实时渲染。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24053 2026-03-13 cs.GR cs.CV 73%

3DGEER: 3D Gaussian Rendering Made Exact and Efficient for Generic Cameras

3DGEER:为通用相机实现精确且高效的3D高斯渲染

Zixun Huang, Cho-Ying Wu, Yuliang Guo, Xinyu Huang, Liu Ren

机构 * Bosch Research North America(博世北美研究部) Bosch Center for AI(博世人工智能中心)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV、cs.GR

AI总结 3DGEER提出了一种几何精确且高效的3D高斯渲染框架,通过闭合表达式实现精确渲染和优化,并在通用相机上实现了实时高效和高精度的光场渲染。

Comments Published at ICLR 2026. Code is available at: https://github.com/boschresearch/3dgeer

Journal ref The Fourteenth International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08958 2026-03-13 cs.CV 57%

Grow with the Flow: 4D Reconstruction of Growing Plants with Gaussian Flow Fields

随流生长:利用高斯流场进行植物生长的4D重建

Weihan Luo, Lily Goli, Sherwin Bahmani, Felix Taubner, Andrea Tagliasacchi, David B. Lindell

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 GrowFlow通过结合3D高斯基元与神经微分方程,实现了植物生长的连续流场建模,提供了一种时间一致的外观建模方法。

Comments Project page: https://weihanluo.ca/growflow/

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 8 篇

2603.09695 2026-03-13 cs.RO cs.CV 81%

DRIFT: Dual-Representation Inter-Fusion Transformer for Automated Driving Perception with 4D Radar Point Clouds

DRIFT:双表示交叉融合变换器用于自动驾驶感知的4D雷达点云

Siqi Pei, Andras Palffy, Dariu M. Gavrila

机构 * Delft University of Technology(代尔夫特理工大学) Perciv AI

专题命中 点云 :point cloud(title,abstract);分类 cs.CV、cs.RO

AI总结 DRIFT通过双路径架构融合局部和全局上下文信息,提升自动驾驶中4D雷达点云的感知性能,实现更准确的物体检测和道路估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11365 2026-03-13 cs.RO 74%

D-SLAMSpoof: An Environment-Agnostic LiDAR Spoofing Attack using Dynamic Point Cloud Injection

D-SLAMSpoof:一种基于动态点云注入的环境无关激光雷达欺骗攻击

Rokuto Nagata, Kenji Koide, Kazuma Ikeda, Ozora Sako, Kentaro Yoshioka

专题命中 点云 :point cloud(title);分类 cs.RO

AI总结 D-SLAMSpoof是一种通过动态点云注入实现的环境无关激光雷达欺骗攻击,利用扫描匹配原理提升攻击成功率,并提出ISD-SLAM作为仅依赖惯性信号的防御方法,有效缓解位置漂移问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11174 2026-03-13 cs.CV 70%

GGPT: Geometry Grounded Point Transformer

GGPT:基于几何的点变换

Yutong Chen, Yiming Wang, Xucong Zhang, Sergey Prokudin, Siyu Tang

机构 * ETH Zurich(苏黎世联邦理工学院) Delft University of Technology(代尔夫特理工大学)

专题命中 点云 :3D reconstruction(abstract);point cloud(abstract);分类 cs.CV

AI总结 GGPT通过引入几何引导的点变换,结合密集前馈预测与显式几何约束,实现了更准确且一致的3D重建,提升了细粒度结构恢复和无纹理区域填补能力。

Comments CVPR 2026, Project website: https://chenyutongthu.github.io/research/ggpt

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11125 2026-03-13 cs.RO cs.CV 62%

ManiVID-3D: Generalizable View-Invariant Reinforcement Learning for Robotic Manipulation via Disentangled 3D Representations

ManiVID-3D: 通用的视角不变强化学习用于机器人操作的解耦3D表示

Zheng Li, Pei Qu, Yufei Jia, Shihui Zhou, Haizhou Ge, Jiahang Cao, Jinni Zhou, Guyue Zhou, Jun Ma

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 ManiVID-3D通过解耦3D表示实现视角不变的强化学习,提升机器人操作在视角变化下的鲁棒性和效率。

Comments Accepted to RA-L. Project website: https://zheng-joe-lee.github.io/manivid3d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11984 2026-03-13 cs.CV 57%

Ada3Drift: Adaptive Training-Time Drifting for One-Step 3D Visuomotor Robotic Manipulation

Ada3Drift: 适应性训练时间漂移用于一步式三维视觉-运动机器人操作

Chongyang Xu, Yixian Zou, Ziliang Feng, Fanman Meng, Shuaicheng Liu

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 Ada3Drift通过将迭代细化从推理时间转移到训练时间,实现高保真的单步三维视觉-运动机器人操作生成,同时在少样本条件下提升性能并减少计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08245 2026-03-13 cs.CG cs.CV 57%

Topologically Stable Hough Transform

拓扑稳定的霍夫变换

Stefan Huber, Kristóf Huszár, Michael Kerber, Martin Uray

机构 * Institute of Geometry, Graz University of Technology, Austria(格拉茨技术大学几何研究所,奥地利) Josef Ressel Centre for Intelligent and Secure Industrial Automation, Salzburg University of Applied Sciences, Austria(约瑟夫·雷斯尔智能与安全工业自动化中心,萨尔茨堡应用科学大学,奥地利)

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 本文提出基于持续同源的霍夫变换变体,用于高效检测点云中的直线。

Comments Extended abstract will be presented at EuroCG'26; 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04848 2026-03-13 cs.RO 57%

Hyperbolic Multiview Pretraining for Robotic Manipulation

双曲多视角预训练用于机器人操作

Jin Yang, Ping Wei, Yixin Chen, Nanning Zheng

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出HyperMVP,一种基于双曲空间的多视角自监督预训练框架,通过GeoLink编码器学习结构化嵌入,提升机器人操作任务的性能。

Comments This paper was submitted to CVPR 2026 and was recommended for Findings, but the authors have withdrawn it and are currently adding more content to submit it elsewhere

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11476 2026-03-13 cs.LG q-bio.QM 50%

Leveraging Phytolith Research using Artificial Intelligence

利用人工智能进行phytolith研究

Andrés G. Mejía Ramón, Kate Dudgeon, Nina Witteveen, Dolores Piperno, Michael Kloster, Luigi Palopoli, Mónica Moraes R., José M. Capriles, Umberto Lombardo

专题命中 点云 :point cloud(abstract)

AI总结 Sorometry通过人工智能整合2D和3D数据,实现phytolith的高效分析与预测,提升考古和古生态研究的精度与标准化。

Comments 45 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 新视角合成 1 篇

2505.20967 2026-03-13 cs.CV 79%

RF4D:Neural Radar Fields for Novel View Synthesis in Outdoor Dynamic Scenes

RF4D:基于雷达的神经场用于户外动态场景的新型视角合成

Jiarui Zhang, Zhihao Li, Chong Wang, Bihan Wen

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡)

专题命中 新视角合成 :novel view synthesis(title,abstract);分类 cs.CV

AI总结 RF4D通过引入雷达特定的神经场框架,提升户外动态场景中新型视角合成的鲁棒性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 3D生成 1 篇

2603.12126 2026-03-13 cs.CV cs.LG 57%

Hoi3DGen: Generating High-Quality Human-Object-Interactions in 3D

Hoi3DGen:生成高质量的人-物交互的3D模型

Agniv Sharma, Xianghui Xie, Tom Fischer, Eddy Ilg, Gerard Pons-Moll

机构 * University of Tübingen(图宾根大学) Tübingen AI Center(图宾根人工智能中心) Max Planck Institute for Informatics(马克斯·普朗克信息学院) Technische Universität Nürnberg(纽伦堡技术大学)

专题命中 3D生成 :3D generation(abstract);分类 cs.CV

AI总结 Hoi3DGen通过多模态大语言模型生成高质量3D人-物交互模型,显著提升交互保真度和3D生成质量,实现文本到3D的高效生成。

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 空间理解 1 篇

2603.12255 2026-03-13 cs.CV cs.LG 57%

Spatial-TTT: Streaming Visual-based Spatial Intelligence with Test-Time Training

空间-TTT:基于流式视觉的空间智能与测试时训练

Fangfu Liu, Diankun Wu, Jiawei Chi, Yimo Cai, Yi-Hsin Hung, Xumin Yu, Hao Li, Han Hu, Yongming Rao, Yueqi Duan

专题命中 空间理解 :spatial understanding(abstract);分类 cs.CV

AI总结 Spatial-TTT通过测试时训练实现流式视觉空间智能,采用混合架构和空间预测机制,提升长时间视频中的空间理解和组织能力。

Comments Project Page: https://liuff19.github.io/Spatial-TTT

详情

展开后加载摘要…

URL PDF HTML 收藏

8. SLAM与定位 1 篇

2603.11389 2026-03-13 cs.CV 70%

High-Precision 6DOF Pose Estimation via Global Phase Retrieval in Fringe Projection Profilometry for 3D Mapping

通过相位全局检索实现高精度6自由度姿态估计用于三维映射的数字光栅投影 profilometry

Sehoon Tak, Keunhee Cho, Sangpil Kim, Jae-Sang Hyun

机构 * Department of Mechanical Engineering, Yonsei University(延世大学机械工程系) Department of Artificial Intelligence, Korea University(韩国大学人工智能系)

专题命中 SLAM与定位 :3D reconstruction(abstract);point cloud(abstract);分类 cs.CV

AI总结 本文提出一种基于全局相位检索的高精度姿态估计方法,通过固有校准的全局投影仪与移动DFP系统结合,实现亚毫米级姿态精度和鲁棒性,适用于准静态场景的3D映射。

详情

展开后加载摘要…

URL PDF HTML 收藏