arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-02 至 2026-06-02 共收录 63 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 14 篇

2505.08438 2026-06-02 cs.CV cs.AI 93%

A Survey of 3D Reconstruction with Event Cameras

事件相机三维重建综述

Chuanzhi Xu, Haoxian Zhou, Langyi Chen, Haodong Chen, Zeke Zexi Hu, Zhicheng Lu, Ying Zhou, Vera Chung, Qiang Qu, Weidong Cai

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 三维重建 :NeRF(summary_cn,abstract);3DGS(summary_cn,abstract);3D reconstruction(title,abstract);Gaussian Splatting(abstract)

AI总结 本文首次全面综述了基于事件相机的三维重建方法,按输入模态(立体、单目、多模态)和重建技术(几何、深度学习、神经渲染如NeRF和3DGS)分类,并讨论了数据集、评估、表示和动态场景重建等挑战。

Comments This survey has been accepted for publication in the Computational Visual Media Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00963 2026-06-02 cs.CV cs.CL 83%

Reasmory: 3D Reconstruction as Explicit Memory for VLMs Spatial Reasoning

Reasmory: 3D重建作为VLMs空间推理的显式记忆

Jixuan He, Xueting Li, Chieh Hubert Lin, Ming-Hsuan Yang

机构 * Cornell Tech, Cornell University(康奈尔科技学院、康奈尔大学) NVIDIA(英伟达) illoca AI(illoca人工智能) The University of California, Merced(加州大学梅尔塞德斯分校)

专题命中 三维重建 :3D reconstruction(title);point cloud(abstract);spatial understanding(abstract);分类 cs.CV

AI总结 提出Reasmory框架,通过结构化程序执行重建的3D显式记忆,并引入轻量级领域特定语言约束VLM查询和操作,在空间推理任务上提升6-18%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23277 2026-06-02 cs.CV 83%

iLRM: An Iterative Large 3D Reconstruction Model

iLRM:一种迭代式大型3D重建模型

Gyeongjin Kang, Seungtae Nam, Seungkwon Yang, Xiangyu Sun, Sameh Khamis, Abdelrahman Mohamed, Eunbyung Park

机构 * Sungkyunkwan University(首尔大学) Yonsei University(延世大学) Rembrand Meta

专题命中 三维重建 :3D reconstruction(title,abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出一种迭代式大型3D重建模型iLRM,通过解耦场景表示、分解多视图交互和注入高分辨率信息,实现高效、可扩展的前馈3D重建,在RE10K和DL3DV数据集上优于现有方法。

Comments Project page: https://gynjn.github.io/iLRM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00444 2026-06-02 cs.CV cs.GR 73%

Real-Time Physics Simulation with Dynamic Mesh-Gaussian Reconstructions

基于动态网格-高斯重建的实时物理仿真

Adrian Ramlal, John S. Zelek

机构 * University of Waterloo(滑铁卢大学)

专题命中 三维重建 :Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 针对动态重建与物理仿真拓扑不兼容的问题,提出固定拓扑网格与高斯泼溅的双表示框架,实现实时物理仿真,并揭示高质量重建与物理兼容拓扑存在本质冲突。

Journal ref Journal of Computational Vision and Imaging Systems, Vol. 11, No. 1, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05293 2026-06-02 cs.CV 70%

Fast-SAM3D: 3Dfy Anything in Images but Faster

Fast-SAM3D: 更快地将图像中的任何物体三维化

Weilun Feng, Mingqiang Wu, Zhiliang Chen, Chuanguang Yang, Haotong Qin, Yuqi Li, Xiaokun Liu, Guoxin Fan, Libo Huang, Yulun Zhang, Michele Magno, Yongjun Xu, Zhulin An

机构 * University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学)

专题命中 三维重建 :3D reconstruction(abstract);3D generation(abstract);分类 cs.CV

AI总结 提出Fast-SAM3D,一种无需训练的三维重建加速框架,通过多级异构性感知机制(模态感知步骤缓存、联合时空令牌雕刻、频谱感知令牌聚合)实现高达2.67倍端到端加速且保真度损失极小。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00137 2026-06-02 cs.CV cs.GR 62%

Advances in Neural 3D Mesh Texturing: A Survey

神经3D网格纹理化进展:综述

Sai Raj Kishore Perla, Hao Zhang, Ali Mahdavi-Amiri

机构 * Simon Fraser University(西蒙弗雷泽大学)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 本文综述了神经3D网格纹理化的最新进展,涵盖纹理合成、迁移和补全方法,并提出了统一的分类体系。

Comments Eurographics STAR (Computer Graphics Forum), 2026. Project Page: https://sairajk.github.io/neural-mesh-texturing/

Journal ref Eurographics STAR (State of The Art Report), Computer Graphics Forum, Volume 45, Number 2, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00054 2026-06-02 cs.RO cs.AI cs.CV 62%

From Human Videos to Robot Manipulation: A Survey on Scalable Vision-Language-Action Learning with Human-Centric Data

从人类视频到机器人操作:基于人类中心数据的可扩展视觉-语言-动作学习综述

Zhiyuan Feng, Qixiu Li, Huizhi Liang, Rushuai Yang, Yichao Shen, Zhiying Du, Zhaowei Zhang, Yu Deng, Li Zhao, Hao Zhao, Zongqing Lu, Oier Mees, Marc Pollefeys, Jiaolong Yang, Baining Guo

机构 * Tsinghua University(清华大学) HKUST(香港科技大学) Xi’an Jiaotong University(西安交通大学) Fudan University(复旦大学) Microsoft Research Asia(微软亚洲研究院) Peking University(北京大学) Microsoft Zurich Project(微软苏黎世实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 本文综述了如何将丰富的人类视频转化为视觉-语言-动作(VLA)模型的有效知识,分类了四种方法(潜在动作表示、预测世界模型、显式2D监督、显式3D重建),并指出了结构化非结构化视频、跨具身和视角的动作映射、以及评估协议设计三大挑战。

Comments Accepted to IJCAI 2026 Survey Track. Project page: https://aaronfengzy.github.io/HumanCentricToVLA-Survey/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09877 2026-06-02 cs.CV cs.AI cs.RO 62%

Genie 4D: Semantic-Prior-Guided 4D Dynamic Scene Reconstruction

Genie 4D:语义先验引导的4D动态场景重建

Yiru Yang, Zhuojie Wu, Nishant Kumar Singh, Max Schulthess

机构 * University of Zurich(苏黎世大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV、cs.RO

AI总结 提出Genie 4D框架,结合实时视觉惯性高斯泼溅前端和前馈4D骨干网络,利用冻结的DINOv3特征作为结构先验抑制身份漂移,并通过条件扩散精炼器恢复高频细节,最终通过轻量级潜在动作头实现用户可控的4D世界模型重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08884 2026-06-02 cs.CV cs.AI cs.GR 62%

ShapeLib: Designing a library of programmatic 3D shape abstractions with Large Language Models

ShapeLib: 利用大型语言模型设计程序化3D形状抽象库

R. Kenny Jones, Paul Guerrero, Niloy J. Mitra, Daniel Ritchie

机构 * Stanford University(斯坦福大学) Adobe Research(Adobe研究) University College London(伦敦大学学院) Brown University(布朗大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV、cs.GR

AI总结 提出ShapeLib方法,利用大型语言模型的先验知识,通过引导式工作流自动设计可泛化的程序化3D形状抽象库,并支持下游形状编辑与生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02479 2026-06-02 cs.CV 57%

Retrieve What's Missing: Coverage-Maximizing Retrieval for Consistent Long Video Generation

检索缺失内容:面向一致长视频生成的覆盖最大化检索

Minseok Joo, Dogyun Park, Taehoon Lee, Kyujin Lee, Hyunwoo J. Kim

机构 * Korea University(韩国大学) KAIST(韩国科学技术院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出基于深度的覆盖最大化检索增强生成框架COVRAG,利用预训练3D先验构建轻量级覆盖图作为记忆证据,通过迭代检索最大化残差覆盖来提升长视频生成的几何一致性。

Comments 19 pages, 10 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02436 2026-06-02 cs.CV 57%

Geometry-Aware Implicit Memory for Video World Models

几何感知隐式记忆用于视频世界模型

Zhengxuan Wei, Xu Guo, Xinghui Li, Xunzhi Xiang, Min Wei, Yiran Zhu, Qiulin Wang, Xintao Wang, Pengfei Wan, Xiangwang Hou, Qi Fan

机构 * School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院) Kling Team, Kuaishou Technology(快手技术 Kling 团队) Tsinghua University(清华大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出GIM-World框架,通过轻量级Transformer编码器将可变长度历史压缩为固定大小的记忆令牌,并利用相机可查询的几何头在训练期间从冻结的基础模型中蒸馏3D场景结构,从而在长时程视频生成中保持几何和视觉一致性。

Comments Project page: https://gim-world.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02021 2026-06-02 cs.CV 57%

PerBite: A Curated Diagnostic Workflow for Bite-Aware Food Volume Estimation

PerBite: 一种用于咬合感知食物体积估计的精选诊断工作流

Ahmad AlMughrabi, Farid Al-Areqi, David Fernández Gómez, Umair Haroon, Marc Bolaños, Ricardo Marques, Petia Radeva

机构 * University of Barcelona(巴塞罗那大学) LogMeal Universitat Pompeu Fabra(庞培法布拉大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出PerBite工作流,通过分割、三维重建、尺度校准和网格后处理等步骤,从餐前餐后状态估计食物体积,在MetaFood挑战中排名第一。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01824 2026-06-02 cs.RO 57%

DisFlow: Scene Flow from Distance Field for Object Pose, Velocity Tracking, and Dynamic Object Reconstruction

DisFlow: 基于距离场的场景流用于物体姿态、速度跟踪和动态物体重建

Lan Wu, Sheila Sutjipto, Jennifer Wakulicz, Teresa Vidal-Calleja

机构 * Robotics Institute, University of Technology Sydney(技术悉尼大学机器人研究所) School of Engineering, University of Western Australia(西澳大学工程学院)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 提出DisFlow框架,利用高斯过程隐式曲面表示从距离场估计场景流,实现6自由度动态物体姿态估计、运动跟踪和表面重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00803 2026-06-02 astro-ph.CO cs.CV cs.LG 57%

Generative Diffusion Priors for 3D Mapping of the Dark Universe

用于暗宇宙三维映射的生成扩散先验

Brandon Zhao, Diana Scognamiglio, Olivier Doré, Katherine L. Bouman

机构 * Department of Computing and Mathematical Sciences, California Institute of Technology(加州理工学院计算与数学科学系) Jet Propulsion Laboratory, California Institute of Technology(加州理工学院喷气推进实验室) Department of Physics, Duke University(杜克大学物理系) Cahill Center for Astronomy and Astrophysics, California Institute of Technology(加州理工学院卡希尔天文与天体物理中心)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 利用扩散模型学习宇宙模拟中的先验分布,结合物理正向模型解决弱引力透镜三维暗物质反问题,显著提升重建精度并生成统计一致的后验样本。

Comments Accepted to CVPR 2026 (Highlight)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 18 篇

2606.00450 2026-06-02 cs.CV cs.GR 91%

Optimizing 3D Gaussian Splatting via Point Cloud Upsampling

通过点云上采样优化3D高斯泼溅

Adrian Ramlal, Yan Song Hu, John S. Zelek

机构 * Vision and Image Processing Group, Systems Design Engineering, University of Waterloo(滑铁卢大学视觉与图像处理组,系统设计工程)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);point cloud(title,abstract);3DGS(abstract,abstract_cn);分类 cs.CV、cs.GR

AI总结 提出多种点云上采样方法及深度引导点提升技术,改善3D高斯泼溅的初始化质量,实验表明不同场景适用不同策略。

Comments Accepted in Journal of Computational Vision and Imaging Systems (JCVIS)

Journal ref Journal of Computational Vision and Imaging Systems, Vol. 10, No. 1, p. 47, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02346 2026-06-02 cs.CV 90%

VEDAL: Variational Error-Driven Asynchronous Learning for 3D Gaussian Splatting Pruning

VEDAL: 用于3D高斯泼溅剪枝的变分误差驱动异步学习

Aoduo Li, Jiancheng Li, Huan Ye, Hongjian Xu, Shiting Wu, Xiujun Zhang, Zimeng Li, Xuhang Chen

机构 * Guangdong University of Technology(广东工业大学) Huizhou Boluo Power Supply Bureau, Guangdong Power Grid Co., Ltd.(惠州市博罗供电局,广东电网有限责任公司) Shenzhen Polytechnic University(深圳职业技术大学) School of Computer Science and Engineering, Huizhou University(惠州市大学计算机科学与工程学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);NeRF(abstract,abstract_cn);3DGS(abstract,abstract_cn);novel view synthesis(abstract)

AI总结 提出VEDAL框架,通过变分自由能最小化、预测误差门控机制和变分不确定性头实现3D高斯泼溅的高效剪枝,在5.2倍压缩下仅损失0.31 dB PSNR。

Comments 12 pages, 5 figures. Accepted by CGI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15491 2026-06-02 cs.CV 90%

GSDeformer: Direct, Real-time and Extensible Cage-based Deformation for 3D Gaussian Splatting

GSDeformer:面向3D高斯泼溅的直接、实时且可扩展的笼形变形方法

Jiajun Huang, Shuolin Xu, Hongchuan Yu, Tong-Yee Lee

机构 * National Centre for Computer Animation(国家计算机动画中心) Bournemouth University(伯恩茅斯大学) Department of Computer Science and Information Engineering(计算机科学与信息工程系)

专题命中 Gaussian Splatting :3DGS(summary_cn,abstract);Gaussian Splatting(title,abstract);point cloud(abstract);分类 cs.CV

AI总结 提出GSDeformer,通过代理点云表示桥接笼形变形与3D高斯泼溅,实现无需重新训练、实时且兼容多种3DGS变体的直接变形。

Comments Project Page: https://jhuangbu.github.io/gsdeformer, Video: https://www.youtube.com/watch?v=-ecrj48-MqM

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00352 2026-06-02 cs.CV cs.GR 88%

HiGS: A Hierarchical Rendering Architecture for Real-Time 3D Gaussian Splatting

HiGS:一种用于实时三维高斯泼溅的分层渲染架构

Dawid Pająk, Martin Bisson, Rodolfo Lima

机构 * NVIDIA

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);novel view synthesis(abstract);分类 cs.CV、cs.GR

AI总结 针对3D高斯泼溅中空间分区与光栅化对瓦片尺寸需求矛盾的问题,提出分层瓦片高斯泼溅(HiGS),通过粗粒度宏瓦片分区和细粒度渲染瓦片光栅化实现加速,在保持精确alpha合成的同时实现最高15.8倍加速。

Comments Project Page: https://research.nvidia.com/labs/sil/projects/higs/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06989 2026-06-02 cs.CV 87%

MipSLAM: Alias-Free Gaussian Splatting SLAM

MipSLAM:无混叠高斯泼溅SLAM

Yingzhao Li, Yan Li, Shixiong Tian, Yanjie Liu, Lijun Zhao, Gim Hee Lee

机构 * State Key Laboratory of Robotics and Systems (HIT), Harbin Institute of Technology(机器人系统国家重点实验室(哈工大)) Yangtze River Delta HlT Robot Technology Research Institute(长江三角洲HLT机器人技术研究院) Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);novel view synthesis(abstract);分类 cs.CV

AI总结 提出MipSLAM框架,通过椭圆自适应抗混叠算法和频谱感知位姿图优化,实现高保真抗混叠新视角合成与鲁棒位姿估计。

Comments Accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00817 2026-06-02 cs.GR cs.CV 86%

Directed Distance Fields for Constant-Time Ray Queries on Gaussian Splatting

定向距离场:用于高斯泼溅的恒定时间射线查询

Subhankar MIshra

机构 * School of Computer Sciences, National Institute of Science Education and Research (NISER)(计算机科学学院,国家科学教育与研究研究所(NISER))

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.CV、cs.GR

AI总结 提出定向距离函数(DDF),将训练好的3D高斯泼溅场景转化为射线预言机,实现恒定时间的射线查询,用于全局光照等二次射线追踪。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01458 2026-06-02 cs.RO 85%

LEGS: Fine-Tuning Teleop-Free VLAs for Humanoid Loco-manipulation in an Embodied Gaussian Splatting World

LEGS: 在具身高斯泼溅世界中免遥操作微调VLA用于人形机器人全身操控

Hojune Kim, Timothy Chen, Jiankai Sun, Lars W. Osterberg, Qianzhong Chen, Ke Wang, Mac Schwager

机构 * Stanford University(斯坦福大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract,abstract_cn);分类 cs.RO

AI总结 提出LEGS混合模拟器,通过程序化运动基元生成器和两阶段颜色校准,无需遥操作即可合成训练数据,使VLA策略在真实人形机器人操控任务中达到或超越遥操作训练效果。

Comments https://legsvla.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00452 2026-06-02 cs.CV cs.GR 85%

Beyond Static Gaussians: An Empirical Investigation of Architectural Paradigms for Dynamic 3D Scene Reconstruction

超越静态高斯:动态3D场景重建架构范式的实证研究

Adrian Ramlal, John S. Zelek

机构 * University of Waterloo(滑铁卢大学)

专题命中 Gaussian Splatting :NeRF(abstract,abstract_cn);3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 本文通过实证比较结构引导与高斯中心两种动态3D高斯溅射范式,揭示重建质量/紧凑性与渲染速度之间的根本权衡。

Comments Accepted in Journal of Computational Vision and Imaging Systems (JCVIS)

Journal ref Journal of Computational Vision and Imaging Systems, Vol. 11, No. 1, 2025, p. 99

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19065 2026-06-02 cs.NI 85%

A Geometric Algebra-Informed 3DGS Framework for Wireless Channel Prediction

一种几何代数驱动的3DGS框架用于无线信道预测

Jingzhou Shen, Tianya Zhao, Xuyu Wang

专题命中 Gaussian Splatting :3DGS(title,title_cn);Gaussian Splatting(abstract)

AI总结 提出几何代数驱动的3D高斯泼溅框架(GAI-GS),通过结合3D高斯泼溅与几何代数注意力机制显式建模复杂传播环境中的射线-物体交互,实现无线信道预测。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20807 2026-06-02 cs.CV cs.RO 84%

RU4D-SLAM: Reweighting Uncertainty in Gaussian Splatting SLAM for 4D Scene Reconstruction

RU4D-SLAM:面向4D场景重建的高斯溅射SLAM不确定性重加权

Yangfan Zhao, Hanwei Zhang, Ke Huang, Qiufeng Wang, Zhenzhou Shao, Dengyu Wu

机构 * Capital Normal University(首都师范大学) Saarland University(萨尔兰大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) King’s College London(伦敦国王学院)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 提出RU4D-SLAM框架,通过引入时间因子、不确定性感知和语义引导重加权机制,解决动态环境中3D高斯溅射SLAM的跟踪与4D场景重建问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06136 2026-06-02 cs.CV cs.AI 83%

GSV3D: Gaussian Splatting-based Geometric Distillation with Stable Video Diffusion for Single-Image 3D Object Generation

GSV3D: 基于高斯溅射的几何蒸馏与稳定视频扩散用于单图像3D物体生成

Ye Tao, Jiawei Zhang, Yahao Shi, Dongqing Zou, Bin Zhou

机构 * State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(虚拟现实技术与系统国家重点实验室,北京航空航天大学) SenseTime Research(商汤科技研究院) PBVR

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3D generation(abstract);分类 cs.CV

AI总结 提出一种结合2D扩散模型隐式3D推理能力与高斯溅射几何蒸馏的方法,通过高斯溅射解码器将SV3D潜变量输出转换为显式3D表示,实现多视图一致性和高质量3D生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01493 2026-06-02 cs.CV 77%

Splatshot: 3D Face Avatar Generation from a Single Unconstrained Photo

Splatshot: 从单张非约束照片生成3D人脸头像

Hao Liang, Zhixuan Ge, Soumendu Majee, Joanna Li, Ashok Veeraraghavan, Guha Balakrishnan

机构 * Rice University(里士大学) Samsung Research America(三星美国研究院)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出SplatShot,一种无需训练的方法,通过将3D高斯泼溅与扩散模型去噪过程耦合,从单张照片生成多视图一致的逼真3D人脸头像。

Comments 28 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01950 2026-06-02 cs.RO cs.CV cs.LG 76%

Learning Action-Conditional and Object-Centric Gaussian Splatting World Models for Rigid Objects

面向刚性物体的学习动作条件与对象中心高斯溅射世界模型

Jens U. Kreber, Lukas Mack, Joerg Stueckler

机构 * Intelligent Perception in Technical Systems Group(技术系统智能感知组)

专题命中 Gaussian Splatting :Gaussian Splatting(title);分类 cs.CV、cs.RO

AI总结 提出MRO-GWM模型,通过对象中心高斯表示和时空变换器架构,学习刚性物体在3D中的动作条件动力学,支持多物体场景和部分观测下的未来运动预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02058 2026-06-02 cs.CV cs.RO 62%

TIDES: Time-Derivative Event Simulation via Deformable Reconstruction

TIDES:基于可变形重建的时间导数事件模拟

Christopher Thirgood, Dipon Kumar Ghosh, Simon Hadfield

机构 * University of Surrey(萨里大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV、cs.RO

AI总结 提出TIDES,一种基于动态高斯泼溅的连续时间事件模拟器,通过显式3D场景表示推导逐像素强度动态,实现精确的阈值交叉预测,并利用遮挡引导自适应时间步长,达到最先进的事件流保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00447 2026-06-02 cs.CV cs.AI 57%

GeoSAM-3D: Geodesic Prompt Propagation for Open-Vocabulary 3D Scene Segmentation from Monocular Video

GeoSAM-3D: 用于从单目视频进行开放词汇3D场景分割的测地线提示传播

Arun Sharma

机构 * University of Minnesota, Twin Cities(明尼苏达大学,双城分校)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出GeoSAM-3D方法,利用冻结的视觉基础模型和单目3D高斯泼溅重建,通过可微分的图-测地线传播核在场景图上传播用户提示,实现从单目视频的开放词汇3D场景分割。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30855 2026-06-02 cs.CV 57%

Robust Dreamer: Deviation-Aware Latent Gaussian Memory for Action-Controlled AR Video Generation

Robust Dreamer: 用于动作控制AR视频生成的偏差感知潜在高斯记忆

Hanlin Chen, Jiaxin Wei, Xibin Song, Yifu Wang, Steve Wang, Hongdong Li, Pan Ji, Gim Hee Lee

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) Technische Universität München(慕尼黑技术大学) Vertex Lab(Vertex实验室) Australian National University(澳大利亚国立大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出Robust Dreamer框架,通过潜在高斯记忆和动态偏差存档解决自回归视频生成中的漂移问题,实现长程3D一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏