arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-03-06 至 2026-03-06 共收录 9 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 9 篇

2603.04847 2026-03-06 cs.CV cs.GR 88%

GloSplat: Joint Pose-Appearance Optimization for Faster and More Accurate 3D Reconstruction

GloSplat:面向更快速和更精确3D重建的联合姿态-外观优化

Tianyu Xiong, Rui Li, Linjie Li, Jiaqi Yang

机构 * Department of Computer Science, Northwestern Polytechnical University, Shanxi, China(计算机科学系,西北工业大学,山西,中国)

专题命中 三维重建 :3D reconstruction(title);NeRF(abstract);Gaussian Splatting(abstract);3DGS(abstract)

AI总结 GloSplat通过联合姿态-外观优化提升3D重建速度和精度,提供无COLMAP和详尽匹配两种变体,实现高效且高质量的重建效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04179 2026-03-06 cs.CV 83%

NOVA3R: Non-pixel-aligned Visual Transformer for Amodal 3D Reconstruction

NOVA3R:非像素对齐的视觉变换器用于模态3D重建

Weirong Chen, Chuanxia Zheng, Ganlin Zhang, Andrea Vedaldi, Daniel Cremers

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心) University of Oxford(牛津大学) Nanyang Technological University(南洋理工大学)

专题命中 三维重建 :3D reconstruction(title,abstract);point cloud(abstract);分类 cs.CV

AI总结 NOVA3R通过非像素对齐的视觉变换器实现更准确的3D重建,解决了传统像素对齐方法在处理可见和不可见点及重叠区域结构上的局限。

Comments Accepted to ICLR 2026. Project Page: https://wrchen530.github.io/nova3r

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24096 2026-03-06 cs.CV cs.AI cs.LG 70%

DiffusionHarmonizer: Bridging Neural Reconstruction and Photorealistic Simulation with Online Diffusion Enhancer

DiffusionHarmonizer: 通过在线扩散增强器连接神经重建与逼真模拟

Yuxuan Zhang, Katarína Tóthová, Zian Wang, Kangxue Yin, Haithem Turki, Riccardo de Lutio, Yen-Yu Chang, Or Litany, Sanja Fidler, Zan Gojcic

机构 * NVIDIA University of Toronto(多伦多大学) Cornell University(康奈尔大学) Technion(技术学院)

专题命中 三维重建 :NeRF(abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 DiffusionHarmonizer通过在线扩散增强器提升神经重建与逼真模拟的结合,解决动态物体整合与伪影问题,提高模拟保真度。

Comments For more details and updates, please visit our project website: https://research.nvidia.com/labs/sil/projects/diffusion-harmonizer

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13454 2026-03-06 cs.CV 70%

Text-to-3D by Stitching a Multi-view Reconstruction Network to a Video Generator

通过将多视角重建网络缝合到视频生成器中实现文本到3D

Hyojun Go, Dominik Narnhofer, Goutam Bhat, Prune Truong, Federico Tombari, Konrad Schindler

机构 * ETH Zurich(苏黎世联邦理工学院) Google(谷歌)

专题命中 三维重建 :3D reconstruction(abstract);3D generation(abstract);分类 cs.CV

AI总结 VIST3A通过将多视角重建网络缝合到视频生成器中,实现文本到3D生成,提升3D场景生成质量。

Comments ICLR 2026 (Oral), Project page: https://gohyojun15.github.io/VIST3A/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05449 2026-03-06 cs.CV cs.AI cs.GR 62%

RealWonder: Real-Time Physical Action-Conditioned Video Generation

RealWonder: 基于实时物理动作的视频生成

Wei Liu, Ziyu Chen, Zizhang Li, Yue Wang, Hong-Xing Yu, Jiajun Wu

机构 * Stanford University(斯坦福大学) University of Southern California(南加州大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 RealWonder通过物理模拟实现实时动作条件视频生成,利用3D重建、物理模拟和简化视频生成器,在单张图像基础上生成高质量视频,适用于多种物理场景。

Comments The first two authors contributed equally. The last two authors advised equally. Project website: https://liuwei283.github.io/RealWonder/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05506 2026-03-06 cs.CV 57%

FaceCam: Portrait Video Camera Control via Scale-Aware Conditioning

FaceCam: 通过尺度感知条件化实现人像视频相机控制

Weijie Lyu, Ming-Hsuan Yang, Zhixin Shu

机构 * University of California, Merced(加州大学梅尔塞德斯分校) Adobe Research(Adobe研究)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 FaceCam通过尺度感知条件化方法,提升单目人像视频的相机控制能力与视觉质量。

Comments Accepted by CVPR 2026. Project page: https://weijielyu.github.io/FaceCam

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05312 2026-03-06 cs.RO 57%

UltraDexGrasp: Learning Universal Dexterous Grasping for Bimanual Robots with Synthetic Data

UltraDexGrasp: 为双臂机器人学习通用灵巧抓取

Sizhe Yang, Yiman Xie, Zhixuan Liang, Yang Tian, Jia Zeng, Dahua Lin, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学) The University of Hong Kong(香港大学) Peking University(北京大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 UltraDexGrasp通过合成数据训练出高效抓取策略,实现双臂机器人在多种物体上的高成功率抓取。

Comments Published at International Conference on Robotics and Automation (ICRA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04614 2026-03-06 cs.CV 57%

SGR3 Model: Scene Graph Retrieval-Reasoning Model in 3D

SGR3模型:三维场景图检索-推理模型

Zirui Wang, Ruiping Liu, Yufan Chen, Junwei Zheng, Weijia Fan, Kunyu Peng, Di Wen, Jiale Wei, Jiaming Zhang, Rainer Stiefelhagen

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Shenzhen University(深圳大学) Hunan University(湖南大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 SGR3模型通过多模态大语言模型与检索增强生成技术,实现无需训练的三维场景图生成,提升场景关系推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19854 2026-03-06 cs.CV 57%

STAvatar: Soft Binding and Temporal Density Control for Monocular 3D Head Avatars Reconstruction

STAvatar: 基于软绑定与时间密度控制的单目3D头部人偶重建

Jiankuo Zhao, Xiangyu Zhu, Zidu Wang, Zhen Lei

机构 * MAIS, Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) CAIR, HKISI, Chinese Academy of Sciences(中国科学院计算技术研究所) SCSE, FIE, M.U.S.T(M.U.S.T)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 STAvatar通过软绑定与时间密度控制方法,实现了单目视频中高保真3D头部人偶的重建,尤其在细粒度细节和遮挡区域的重建上表现优异。

Comments Accepted to CVPR 2026. Project page: https://jiankuozhao.github.io/STAvatar/

详情

展开后加载摘要…

URL PDF HTML 收藏