arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-03-10 至 2026-03-10 共收录 11 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 11 篇

2603.08055 2026-03-10 cs.CV cs.AI 79%

Speed3R: Sparse Feed-forward 3D Reconstruction Models

Speed3R: 稀疏前馈3D重建模型

Weining Ren, Xiao Tan, Kai Han

机构 * The University of Hong Kong(香港大学) Baidu AMU(百度AMU)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 Speed3R通过稀疏关键点匹配机制实现高效3D重建,以12.4倍速度提升推理效率,同时保持几何精度。

Comments CVPR 2026 Findings, project page: https://visual-ai.github.io/speed3r/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06956 2026-03-10 cs.CV 70%

Virtual Intraoperative CT (viCT): Sequential Anatomic Updates for Modeling Tissue Resection Throughout Endoscopic Sinus Surgery

虚拟术中CT(viCT):用于内窥镜鼻窦手术中逐步更新解剖结构的建模方法

Nicole M. Gunderson, Graham J. Harris, Jeremy S. Ruthberg, Pengcheng Chen, Di Mao, Randall A. Bly, Waleed M. Abuzeid, Eric J. Seibel

机构 * Department of Otolaryngology–Head and Neck Surgery, University of Washington(耳鼻喉科-头颈外科系,华盛顿大学)

专题命中 三维重建 :NeRF(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 viCT通过术中内窥镜视频生成3D重建,实现内窥镜鼻窦手术中解剖结构的逐步更新,提升术中可视化精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08254 2026-03-10 cs.CV 57%

DynamicVGGT: Learning Dynamic Point Maps for 4D Scene Reconstruction in Autonomous Driving

DynamicVGGT: 为自动驾驶中的4D场景重建学习动态点图

Zhuolin He, Jing Li, Guanghao Li, Xiaolei Chen, Jiacheng Tang, Siyang Zhang, Zhounan Jin, Feipeng Cai, Bin Li, Jian Pu, Jia Cai, Xiangyang Xue

机构 * Fudan University(复旦大学) Huawei(华为) Yinwang Intelligent Technology(依文智能技术) Shanghai Innovation Institute(上海创新研究院) CUHK(香港中文大学)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 DynamicVGGT通过联合预测当前和未来点图,结合Motion-aware Temporal Attention模块和动态3D高斯点散射头,实现了自动驾驶中4D动态场景的高精度重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07441 2026-03-10 cs.CV 57%

DogWeave: High-Fidelity 3D Canine Reconstruction from a Single Image via Normal Fusion and Conditional Inpainting

DogWeave: 通过法线融合与条件修复从单张图像实现高保真3D犬只重建

Shufan Sun, Chenchen Wang, Zongfu Yu

机构 * University of Wisconsin--Madison(威斯康星大学麦迪逊分校)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 DogWeave通过法线融合与条件修复技术,从单张图像实现高保真3D犬只重建,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19914 2026-03-10 cs.RO 57%

They See Me Rolling: High-Speed Event Vision-Based Tactile Roller Sensor for Large Surface Inspection

他们能看到我滚动:基于高速事件视觉的触觉滚轮传感器用于大表面检测

Akram Khairi, Hussain Sajwani, Abdallah Mohammad Alkilany, Laith AbuAssi, Mohamad Halwani, Islam Mohamed Zaid, Ahmed Awadalla, Dewald Swart, Abdulla Ayyad, Yahya Zweiri

机构 * Advanced Research and Innovation Center(先进研究与创新中心) Khalifa University(卡利法大学) Department of Aerospace Engineering(航空航天工程系) Research and Development(研发部) Strata Manufacturing PJSC(斯特拉制造公司)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 本文提出了一种基于高速事件视觉的触觉滚轮传感器,实现高速连续高分辨率的大面积表面检测,扫描速度达0.5m/s,精度达100微米以内,且通过多参考贝叶斯融合策略提升准确性。

Comments Accepted to IEEE T-RO - Project Page: https://akramekhairi.github.io/TheySeeMeRolling/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17635 2026-03-10 cs.CV 57%

LangSurf: Language-Embedded Surface Gaussians for 3D Scene Understanding

LangSurf: 语言嵌入的表面高斯用于3D场景理解

Hao Li, Minghan Qin, Zhengyu Zou, Diqi He, Xinhao Ji, Bohan Li, Bingquan Dai, Dingewn Zhang, Junwei Han

机构 * Brain and Artificial Intelligence Lab, Northwestern Polytechnical University(脑科学与人工智能实验室,西北工业大学) Tsinghua University(清华大学) Shanghai Jiaotong University(上海交通大学) Peking University(北京大学) School of Artifical Intelligence, Chongqing University of Posts and Telecommunications(人工智能学院,重庆邮电大学)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 LangSurf通过语言嵌入的表面高斯实现3D场景理解,提升2D和3D分割精度,扩展了下游任务如去除和编辑。

Comments \url{https://langsurf.github.io}

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07144 2026-03-10 cs.CV 57%

CanoVerse: 3D Object Scalable Canonicalization and Dataset for Generation and Pose

CanoVerse: 3D对象可扩展规范化的数据集用于生成和姿态

Li Jin, Yuchen Yang, Weikai Chen, Yujie Wang, Dehao Hao, Tanghui Jia, Yingda Yin, Zeyu Hu, Runze Zhang, Keyang Luo, Li Yuan, Long Quan, Xin Wang, Xueying Qin

机构 * SDU(1 南开大学) LIGHTSPEED(2 LIGHTSPEED) UNC Chapel Hill(3 匹兹堡大学柴尔德斯分校) HKUST(4 香港理工大学) PKU(5 北京大学)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 CanoVerse通过大规模规范3D数据集提升3D生成稳定性,实现跨模态检索与零样本点云方向估计

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06982 2026-03-10 cs.CV cs.IR 57%

Optimizing Multi-Modal Models for Image-Based Shape Retrieval: The Role of Pre-Alignment and Hard Contrastive Learning

优化多模态模型用于基于图像的形状检索:预对齐和硬对比学习的作用

Paul Julius Kühn, Cedric Spengler, Michael Weinmann, Arjan Kuijper, Saptarshi Neil Sinha

机构 * Fraunhofer IGD(弗劳恩霍夫图像研究中心) Delft University of Technology(代尔夫特理工大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出通过预对齐和硬对比学习优化多模态模型,提升基于图像的形状检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06971 2026-03-10 cs.CV 57%

SurgCUT3R: Surgical Scene-Aware Continuous Understanding of Temporal 3D Representation

SurgCUT3R: 术场景感知的连续时间3D表示理解

Kaiyuan Xu, Fangzhou Hong, Daniel Elson, Baoru Huang

机构 * The Hamlyn Centre for Robotic Surgery, Imperial College London(机器人手术中心,帝国理工学院伦敦分校) S-Lab, College of Computing and Data Science, Nanyang Technological University(S实验室, computing and Data Science学院,南洋理工大学) Department of Computer Science, University of Liverpool(计算机科学系,利物浦大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 SurgCUT3R通过数据生成、混合监督和分层推理框架,解决手术场景中3D重建的准确性和效率问题,实现稳健的重建性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06684 2026-03-10 cs.CV eess.IV 57%

Three-dimensional reconstruction and segmentation of an aggregate stockpile for size and shape analyses

三维重建与堆料堆的分割用于尺寸和形状分析

Erol Tutumluer, Haohang Huang, Jiayi Luo, Issam Qamhia, John M. Hart

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出了一种基于移动设备的3D成像方法,用于现场快速获取堆料颗粒的3D尺寸和形状信息,以提高道路建设材料的质量控制效率。

Comments 7 pages, 4 figures, Proceedings of the 20th International Conference on Soil Mechanics and Geotechnical Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21302 2026-03-10 cs.CV 57%

Quantized Visual Geometry Grounded Transformer

量化视觉几何基础变换器

Weilun Feng, Haotong Qin, Mingqiang Wu, Chuanguang Yang, Yuqi Li, Xiangqi Li, Zhulin An, Libo Huang, Yulun Zhang, Michele Magno, Yongjun Xu

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院人工智能安全国家重点实验室,计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) ETH Zürich(苏黎世联邦理工学院) City College of New York, City University of New York, USA(纽约城市学院,纽约城市大学,美国) Shanghai Jiao Tong University(上海交通大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出QuantVGGT,首个针对大规模VGGT的量化框架,通过双平滑细粒度量化和噪声过滤多样化采样技术,在保持高精度的同时实现显著的内存减少和加速。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏