arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-30 至 2026-06-30 共收录 9 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 9 篇

2606.30352 2026-06-30 cs.CV 89%

FastPano3D: Feed-Forward Indoor Panoramic 3D Reconstruction from a Single Image

FastPano3D:基于单张图像的前馈式室内全景三维重建

Jianqiang Li, Liumei Zhang, Wenjia Guo, Tianlong Feng, Yongzhi Liao, Di Lu, Hanchi Ren, Jingjing Deng

机构 * Xi’an Shiyou University(西安电子科技大学) Xidian University(西安电子科技大学) Swansea University(斯旺西大学) University of Bristol(布里斯托大学)

专题命中 三维重建 :3D reconstruction(title);NeRF(abstract,abstract_cn);3DGS(abstract,abstract_cn);Gaussian Splatting(abstract)

AI总结 提出FastPano3D框架,从单张全景图直接生成可渲染的3D高斯表示,通过轻量编码器、自适应采样和点云引导优化,实现无需测试优化的快速高质量重建,速度比Pano2Room快156倍。

Comments Preprint. Under review. 20 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29179 2026-06-30 eess.IV cs.AR cs.MM 67%

Performance Analysis of Hardware-Accelerated 10-Bit 4:2:2 Encoding with Split-Frame Encoding for High-Fidelity V-PCC Streaming

基于分帧编码的硬件加速10位4:2:2编码在高保真V-PCC流媒体中的性能分析

Kasidis Arunruangsirilert, Jiro Katto

专题命中 三维重建 :3D reconstruction(abstract);point cloud(abstract)

AI总结 针对高保真V-PCC流媒体对10位4:2:2编码的实时需求,本文利用Blackwell GPU的四个硬件编码器实现分帧编码,达到122 fps吞吐量,验证了通用GPU的可行性。

Comments 2026 IEEE International Conference on Image Processing Workshops (ICIP 2026), 13-17 September 2026, Tampere, Finland

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05377 2026-06-30 cs.RO cs.CV 62%

OpenFrontier: General Navigation with Visual-Language Grounded Frontiers

OpenFrontier: 基于视觉-语言基础的通用导航

Esteban Padilla-Cerdio, Boyang Sun, Marc Pollefeys, Hermann Blum

机构 * ETH Zurich(苏黎世联邦理工学院) Microsoft Spatial AI Lab(微软空间人工智能实验室) University of Bonn(波恩大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 本文提出OpenFrontier框架,通过稀疏子目标识别与到达问题实现高效导航,无需任务特定训练或微调,适用于多种视觉-语言先验模型,展示零样本性能和真实机器人部署效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30131 2026-06-30 cs.CV cs.AI 57%

Hyper-Network Neural Functional Maps for Unsupervised Robust 3D Shape Matching

超网络神经功能映射用于无监督鲁棒3D形状匹配

Dongliang Cao, Florian Bernard

机构 * University of Bonn(波恩大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 针对非刚性3D形状匹配中部分性、拓扑噪声等挑战,提出超网络预测非线性神经功能映射(NFM),以无监督方式学习对齐谱基,显著提升匹配精度。

Comments ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29167 2026-06-30 cs.CV 57%

Articulating then Matching: Zero-Shot Shape Matching for Uncurated Data

先表达后匹配:面向非整理数据的零样本形状匹配

Qilong Liu, Qinfeng Xiao, Chenyuan Yi, Liying Zhang, Kit-lun Yick

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 提出ATM零样本框架,通过先表达后匹配范式,利用预训练视觉基础模型和参数化形状先验,从多视图渲染中估计参数化形状模型,并基于多视图几何一致性进行系统校准,实现无需对应训练、抗拓扑噪声、兼容多种3D模态的鲁棒密集对应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28396 2026-06-30 cs.CV cs.LG 57%

RadarTwin: Scene-Specific mmWave Radar Simulation and Learning for Mobile Indoor Perception

RadarTwin:面向移动室内感知的场景特定毫米波雷达仿真与学习

Emily Bejerano, Federico Tondolo, Devang Gupta, Aaron Mano Cherian, Taeyoo Kim, Ayaan Qayyum, Xiaofan Yu, Xiaofan Jiang

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出RadarTwin框架,利用3D重建和视觉语言模型推断材料属性,通过物理射线追踪合成FMCW雷达数据,解决雷达数据稀缺问题,仿真训练模型在真实场景中识别物体准确率达95.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22960 2026-06-30 cs.CV 57%

UCM: Unified Modeling of Camera Control and Memory with Time-aware Positional Encoding Warping for World Models

UCM:基于时间感知位置编码变形的相机控制与内存统一建模

Tianxing Xu, Zixuan Wang, Guangyuan Wang, Li Hu, Zhongyi Zhang, Peng Zhang, Bang Zhang, Songhai Zhang

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 UCM通过时间感知位置编码变形机制实现相机控制与长期记忆的统一建模,在真实和合成基准测试中显著提升场景一致性并实现高保真视频生成的精确控制。

Comments Project Page: https://humanaigc.github.io/ucm-webpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13539 2026-06-30 cs.CG cs.CV cs.LG math.DG math.GT 57%

EuLearn: A 3D database for learning Euler characteristics

EuLearn:一种用于学习欧拉特征的3D数据库

Rodrigo Fritz, Pablo Suárez-Serrato, Victor Mijangos, Anayanzi D. Martinez-Hernandez, Eduardo Ivan Velazquez Richards

机构 * Instituto de Matemáticas, UNAM(墨西哥国立自治大学数学研究所) Facultad de Ciencias, UNAM(墨西哥国立自治大学理学院) IIMAS, UNAM(墨西哥国立自治大学应用数学与系统研究所)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出EuLearn,首个全面代表多种拓扑类型的3D表面数据集,通过随机结生成均匀变化的曲面,提供网格、点云和标量场数据,旨在提升机器学习系统对拓扑特征的识别能力。

Comments 35 pages, many figures. Datasets and source code publicly available at https://huggingface.co/datasets/appliedgeometry/EuLearn and https://github.com/appliedgeometry/EuLearn_db

Journal ref Machine Learning: Science and Technology, Volume 7, Number 3, May 5th, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11826 2026-06-30 astro-ph.GA 50%

ODIN: Characterizing the Three-dimensional Structure of Two Protocluster Complexes at $z = 3.1$

ODIN:表征z=3.1处两个原型团复合体的三维结构

Vandana Ramakrishnan, Ashley Ortiz, Byeongha Moon, Eunsoo Jun, David Schlegel, Kyoung-Soo Lee, Jessica Nicole Aguilar, Maria Celeste Artale, David Brooks, Maria Candela Cerdosino, Robin Ciardullo, Todd Claybaugh, Andrei Cuceu, Axel de la Macorra, Arjun Dey, Nicole M. Firestone, Andreu Font-Ribera, Jaime E. Forero-Romero, Eric Gawiser, Enrique Gaztañaga, Caryl Gronwall, Lucia Guaita, Gaston Gutierrez, Sungryong Hong, Ho Seong Hwang, Sang Hyeok Im, Paulina Troncoso Iribarren, Woong-Seob Jeong, Dick Joyce, Ankit Kumar, Claire Lamman, Martin Landriau, Seong-Kook Lee, Jaehyun Lee, Aaron Meisner, Ramon Miquel, John Moustakas, Seshadri Nadathur, Gautam Nagaraj, Julie Nantais, Nelson Padilla, Changbom Park, Will Percival, Francisco Prada, Ignasi Pérez-Ràfols, Graziano Rossi, Eusebio Sanchez, Joseph Harry Silber, Hyunmi Song, David Sprayberry, Gregory Tarlé, Francisco Valdes, Yujin Yang, Ann Zabludoff, Hu Zou

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 研究通过结合光谱和光度数据,重建z=3.1处两个原型团复合体的三维结构,发现其形态不规则且沿单一轴延伸,揭示了视线对结构形态感知的影响。

Comments 29 pages, 15 figures, accepted for publication in ApJ. Website hosting interactive 3D visualizations available and linked in the manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏