arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 3137 信号源:cs.CV, cs.GR, cs.RO

1. Gaussian Splatting 3137 篇

2510.19255 2026-06-17 cs.CV 版本更新 77%

Advances in 4D Representation: Geometry, Motion, and Interaction

4D表示进展:几何、运动与交互

Mingrui Zhao, Sauradip Nag, Kai Wang, Aditya Vora, Guangda Ji, Peter Chun, Ali Mahdavi-Amiri, Hao Zhang

机构 * Simon Fraser University(西蒙弗雷泽大学) University of Alberta(阿尔伯塔大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文综述了4D生成与重建领域,从几何、运动和交互三个核心支柱出发,分析不同4D表示方法的特性、挑战及适用场景,并探讨了大语言模型和视频基础模型在其中的作用。

Comments CGF'26,21 pages. Project Page: https://mingrui-zhao.github.io/4DRep-GMI/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16232 2026-06-16 cs.RO 新提交 77%

PolyMerge: Compressing 3D Gaussian Splats with Polytope Coverings for Provably Safe Resource-Constrained Navigation

PolyMerge: 用多面体覆盖压缩3D高斯泼溅以实现可证明安全的资源受限导航

Jihoon Hong, Chih-Yuan Chiu, Sara Fridovich-Keil, Glen Chou

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.RO

AI总结 提出PolyMerge,将大规模3D高斯泼溅模型转换为凸多面体覆盖,保证覆盖原模型所有障碍物,结合控制障碍函数实现实时安全路径规划,在Crazyflie无人机上验证。

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 7, pp. 8512-8519, July 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15659 2026-06-16 cs.CV 新提交 77%

SpatialAvatar-0: High-Quality 4D Head Avatar with Multi-Stage Reconstruction

SpatialAvatar-0: 高质量4D头部虚拟形象的多阶段重建

Yiran Wang, Zeyu Zhang, Yuanming Li, Ziming Wang, Yang Zhao

机构 * USYD(悉尼大学) SpatialReal ZJU(浙江大学) La Trobe(拉筹伯大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出基于FLAME网格绑定高斯表示的多阶段框架,通过前馈生成器和10K迭代布局保持微调,实现跨域零样本和单目基准领先性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06212 2026-06-16 cs.CV cs.AI 版本更新 77%

Akasha 2: Hamiltonian State Space Duality and Visual-Language Joint Embedding Predictive Architectur

Akasha 2: 哈密顿状态空间对偶与视觉-语言联合嵌入预测架构

Yani Meziani

机构 * Independent AI Researcher(独立AI研究员) Québec (QC), Canada(魁北克(QC),加拿大)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出 Akasha 2 多模态架构,结合哈密顿状态空间对偶与视觉-语言联合嵌入预测,通过稀疏混合哈密顿专家和哈密顿流匹配实现超低延迟视频预测与合成,在保持能量守恒下取得 SOTA 性能。

Comments No supporting claims were validated in this automated agentic R&D research run

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10578 2026-06-08 cs.CV 版本更新 77%

Rein3D: Reinforced 3D Indoor Scene Generation with Panoramic Video Diffusion Models

Rein3D: 基于全景视频扩散模型的强化3D室内场景生成

Dehui Wang, Rong Wei, Yue Shi, Congsheng Xu, Shoufa Chen, Dingxiang Luo, Tianshuo Yang, Xiaokang Yang, Wei Sui, Yusen Qin, Rui Tang, Yao Mu

机构 * Shanghai Jiao Tong University(上海交通大学) Manycore Tech Inc.(Manycore科技公司) D-Robotics The University of Hong Kong(香港大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出Rein3D框架,结合3D高斯泼溅与视频扩散模型,通过“恢复-细化”范式从稀疏输入生成全局一致的360度室内场景,并构建PanoV2V-15K数据集,显著提升长距离相机探索效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04158 2026-06-04 cs.RO 77%

Multi-Agent Next-Best-View Optimization for Risk-Averse Planning

多智能体风险规避规划中的下一最佳视角优化

Amirhossein Mollaei Khass, Vivek Pandey, Guangyi Liu, Athanasios Cosse, Emrah Bayrak, Nader Motee

机构 * Department of Mechanical Engineering and Mechanics, Lehigh University(莱文大学机械工程与力学系) Amazon Robotics(亚马逊机器人)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.RO

AI总结 提出一种分布式、风险感知的多智能体下一最佳视角框架,通过共识ADMM优化信息增益并建模碰撞风险,在降低通信开销的同时接近集中式方法的映射质量和轨迹安全性。

Comments 8 pages, 5 figures. Submitted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03877 2026-06-03 cs.CV 77%

MLP Splatting: Object-Centric Neural Fields

MLP Splatting: 以对象为中心的神经场

Shinjeong Kim, Yuzhou Cheng, Xin Kong, Paul H. J. Kelly, Andrew J. Davison

机构 * Department of Computing, Imperial College London(帝国理工学院伦敦分校计算机系)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出MLP-Splatting方法,通过少量紧凑MLP原语实现场景分解和新视角合成,支持对象级编辑且内存和渲染效率优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01493 2026-06-02 cs.CV 77%

Splatshot: 3D Face Avatar Generation from a Single Unconstrained Photo

Splatshot: 从单张非约束照片生成3D人脸头像

Hao Liang, Zhixuan Ge, Soumendu Majee, Joanna Li, Ashok Veeraraghavan, Guha Balakrishnan

机构 * Rice University(里士大学) Samsung Research America(三星美国研究院)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出SplatShot,一种无需训练的方法,通过将3D高斯泼溅与扩散模型去噪过程耦合,从单张照片生成多视图一致的逼真3D人脸头像。

Comments 28 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25751 2026-05-26 cs.CV 77%

SplitAvatar: One-shot Head Avatar with Autoregressive Gaussian Splitting

SplitAvatar: 基于自回归高斯分裂的单次头部化身

Hongzhe Liao, Chuhua Xian, Hongmin Cai, Haiyang Liu, Fa-Ting Hong

机构 * South China University of Technology(华南理工大学) University of Tokyo(东京大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出一种基于自回归高斯分裂的单图像可动画头部化身重建方法,通过图分裂网络渐进生成高斯体,解决高斯数量不匹配和细粒度细节缺失问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25373 2026-05-26 cs.CV 77%

Physics-Aware 3D Gaussian Editing for Driving Scene Generation

物理感知的三维高斯编辑用于驾驶场景生成

Feng Zhou, Jian Zhang, Yuhang Sun, He Wang, Qiong Wen, Debao Kong, Tieru Wu, Rui Ma

机构 * School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) National Key Laboratory of Automotive Chassis Integration and Bionics, Jilin University(吉林大学汽车底盘集成与生物力学国家重点实验室) China FAW Group Co., Ltd.(中国第一汽车集团有限公司)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出RoVES系统,通过单图像驱动的道路几何插入和4-DOF半车动力学模型,实现物理感知的驾驶场景编辑与车辆姿态校正。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21935 2026-05-22 cs.RO 77%

Learning to Evolve: Multi-modal Interactive Fields for Robust Humanoid Navigation in Dynamic Environments

学习进化:多模态交互场用于动态环境中的稳健双足机器人导航

Peifeng Jiang, Hong Liu, Jin Jin, Wenshuai Wang, Xia Li

机构 * State Key Laboratory of General Artificial Intelligence, Peking University, Shenzhen Graduate School(一般人工智能国家重点实验室,北京大学深圳研究生院) Oxford Robotics Institute, University of Oxford(牛津大学机器人研究所) Institute for Machine Learning, Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系机器学习研究所)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.RO

AI总结 本文提出多模态交互场(MIF)系统,通过结合置信度感知的语义3D高斯溅射、差异触发的空间记忆更新和任务驱动的几何重建,在闭环感知-适应管道中实现稳健的双足机器人导航,显著提高了非静态环境中的重定位成功率并减少了语义内存足迹。

Comments Accepted by Robotics: Science and Systems 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20872 2026-05-21 cs.LG cs.AI cs.GR 77%

CAdam: Context-Adaptive Moment Estimation for 3D Gaussian Densification in Generative Distillation

CAdam: 3D高斯密度细化中的上下文自适应矩估计

SeungJeh Chung, Geonho Park, Misong Kim, HyeongYeop Kang

机构 * IIIXR Lab, Kyung Hee University(庆尚大学IIIXR实验室) IIIXR Lab, Korea University(韩国大学IIIXR实验室)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.GR

AI总结 本文提出CAdam方法,通过将密度细化问题转化为统计信号验证问题,解决生成式蒸馏中密度估计的瓶颈,从而在保持视觉质量的同时显著减少高斯点数量。

Comments Accepted to SIGGRAPH 2026 Conference Papers. 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19600 2026-05-20 cs.RO 77%

FlyMirage: A Fully Automated Generation Pipeline for Diverse and Scalable UAV Flight Data via Generative World Model

FlyMirage: 一种用于生成多样化和可扩展的无人机飞行数据的完全自动化生成流程

Jinhan Li, Xijie Huang, Zhaoqi Wang, Yijin Wang, Weiqi Ge, Qiyi He, Mo Zhu, Fei Gao, Yuze Wu, Xin Zhou

机构 * State Key Laboratory of Industrial Control Technology, Zhejiang University, Hangzhou 310027, China(浙江大学工业控制技术状态重点实验室,杭州310027,中国) Differential Robotics, Hangzhou 311121, China(差分机器人,杭州311121,中国)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.RO

AI总结 本文提出FlyMirage,一种完全自动化的生成流程,通过生成世界模型生成大规模、多样化且逼真的无人机视觉-语言导航数据,支持下一代具身导航模型的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17916 2026-05-20 cs.CV 77%

PanoWorld: A Generative Spatial World Model for Consistent Whole-House Panorama Synthesis

PanoWorld: 一种生成式空间世界模型,用于一致的整屋全景合成

Jinrang Jia, Zhenjia Li, Yijiang Hu, Yifeng Shi

机构 * Ke Holdings Inc.(凯控股有限公司)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);3D generation(abstract);分类 cs.CV

AI总结 本文提出PanoWorld,一种生成式空间世界模型,通过自回归生成基于节点的360度全景图,实现一致的整屋全景合成,解决了纯2D生成器在视角变化时几何和材质重新想象的问题,以及单一3D生成在多房间尺度下的高成本和纹理丢失问题。

Comments 17

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17777 2026-05-19 cs.CV 77%

Efficient Sparse-to-Dense Visual Localization via Compact Gaussian Scene Representation and Accelerated Dense Pose Estimation

通过紧凑的高斯场景表示和加速的密集姿态估计实现高效的稀疏到密集视觉定位

Zizhuo Li, Songchu Deng, Linfeng Tang, Jiayi Ma

机构 * Electronic Information School, Wuhan University(武汉大学电子信息学院) School of Robotics, Wuhan University(武汉大学机器人学院) Electronic Information School and the School of Robotics, Wuhan University(武汉大学电子信息学院和机器人学院)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文提出了一种高效的视觉定位方法LiteLoc,通过去除冗余的色彩字段和优化密集姿态估计,显著提升了内存和计算效率,同时保持了定位性能。

Comments IEEE/CAA JAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14009 2026-05-19 cs.RO 77%

GRaD-Nav++: Vision-Language Model Enabled Visual Drone Navigation with Gaussian Radiance Fields and Differentiable Dynamics

GRaD-Nav++: 基于视觉-语言模型的视觉无人机导航:高斯辐射场与可微动力学

Qianzhong Chen, Naixiang Gao, Suning Huang, JunEn Low, Timothy Chen, Jiankai Sun, Mac Schwager

机构 * Department of Mechanical Engineering, Stanford University(斯坦福大学机械工程系) Department of Aeronautics and Astronautics, Stanford University(斯坦福大学航空航天工程系)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.RO

AI总结 GRaD-Nav++提出一种轻量级视觉-语言-动作框架,通过可微强化学习在3D高斯点云模拟器中训练,实现基于自然语言指令的实时无人机导航,展示在多任务和多环境下的高效导航能力。

Comments Published in: IEEE Robotics and Automation Letters ( Volume: 11, Issue: 2, February 2026)

Journal ref Chen, Qianzhong, et al. "Grad-nav++: Vision-language model enabled visual drone navigation with gaussian radiance fields and differentiable dynamics." IEEE Robotics and Automation Letters 11.2 (2025): 1418-1425

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11594 2026-05-13 cs.CV 77%

PointForward: Feedforward Driving Reconstruction through Point-Aligned Representations

PointForward:通过点对齐表示实现馈送驾驶重建

Cheng Chi, Xianqi Wang, Hongcheng Luo, Mingfei Tu, Gangwei Xu, Zehan Zhang, Bing Wang, Guang Chen, Hangjun Ye, Sida Peng, Xin Yang, Haiyang Sun

机构 * Xiaomi EV(小米电动车) Huazhong University of Science and Technology(华中科技大学) Zhejiang University(浙江大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 PointForward通过点对齐表示实现驾驶场景重建,采用空间时间融合提升多视角一致性,引入场景图处理动态实例,实现高精度驾驶场景重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09956 2026-05-12 cs.CV cs.AI 77%

SDTalk: Structured Facial Priors and Dual-Branch Motion Fields for Generalizable Gaussian Talking Head Synthesis

SDTalk: 结构化面部先验与双分支运动场用于通用化的高斯说话头合成

Peng Jia, Zhen Xiao, Jia Li, Xueliang Liu, Zhenzhen Hu, Lingyun Yu

机构 * Hefei University of Technology(合肥工业大学) University of Science and Technology of China(中国科学技术大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 SDTalk通过结构化面部先验和双分支运动场,实现无需个性化训练的通用高斯说话头合成,提升视觉质量和推理效率。

Comments 5 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01232 2026-05-05 cs.RO 77%

A Principled Approach for Creating High-fidelity Synthetic Demonstrations for Imitation Learning

为模仿学习创建高保真合成演示的原理性方法

Moniruzzaman Akash, Momotaz Begum

机构 * Spot mobile manipulator(Spot移动机械臂)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.RO

AI总结 本文提出基于动态运动基元的框架,通过保留专家轨迹结构生成多样化演示,实现高保真渲染与几何推理的统一。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19216 2026-04-30 cs.NI cs.AI cs.CV cs.LG 77%

Bridging Visual and Wireless Sensing via a Unified Radiation Field for 3D Radio Map Construction

通过统一的辐射场桥接视觉与无线传感以实现3D无线电地图构建

Chaozheng Wen, Jingwen Tong, Zehong Lin, Chenghong Bian, Jun Zhang

机构 * Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 Gaussian Splatting :NeRF(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文提出URF-GS框架,结合3D高斯散射和反渲染技术,融合多模态数据以提升3D无线电地图的空间频谱精度和样本效率。

Comments The code for this work will be publicly available at: https://github.com/wenchaozheng/URF-GS

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07940 2026-04-28 cs.CV 77%

ISExplore:Informative Segment Selection for Efficient Personalized 3D Talking Face Generation

ISExplore:基于信息片段选择的高效个性化3D说话人脸生成

Rui-Qing Sun, Ang Li, Zhijing Wu, Tian Lan, Qianyu Lu, Xingshan Yao, Chen Xu, Xian-Ling Mao

机构 * Beijing Institute of Technology(北京理工大学)

专题命中 Gaussian Splatting :NeRF(abstract);Gaussian Splatting(abstract);3DGS(abstract);分类 cs.CV

AI总结 本文提出ISExplore方法,通过选择少量高信息量视频片段提升个性化3D说话人脸生成效率,减少5倍的处理时间并保持高质量生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11098 2026-04-23 cs.CV cs.LG eess.SP 77%

Efficient Transceiver Design for Aerial Image Transmission and Large-scale Scene Reconstruction

高效空中图像传输与大规模场景重建的收发器设计

Zeyi Ren, Jialin Dong, Wei Zuo, Yikun Wang, Bingyang Cheng, Sheng Zhou, Zhisheng Niu

机构 * Department of Electronic Engineering, Tsinghua University, Beijing, China(清华大学电子工程系) Department of Electrical and Computer Engineering, The University of Hong Kong, Hong Kong(香港大学电子与计算机工程系)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文提出一种基于深度学习的端到端收发器设计,整合3D高斯点划法提升场景恢复质量,通过稀疏导频方案降低传输开销,实现实时高效的大规模场景重建。

Comments 6 pages, 6 figures, Accepted in ISIT 2026 IEEE International Symposium on Information Theory-w

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02034 2026-04-21 cs.CV 77%

SemMorph3D: Unsupervised Semantic-Aware 3D Morphing via Mesh-Guided Gaussians

SemMorph3D:通过网格引导高斯进行无监督的语义感知3D变形

Mengtian Li, Yunshu Bai, Yimin Chu, Xinru Guo, Haolin Liu, Zhifeng Xie, Chaofeng Chen

机构 * Shanghai University School of Artificial Intelligence , Wuhan University Tencent Shanghai Engineering Research Center of Motion Picture Special Effects(上海大学人工智能学院、武汉大学、腾讯、上海影视特效工程研究中心)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 SemMorph3D通过网格引导高斯方法实现从多视角图像直接生成语义感知的3D形状和纹理变形,解决传统方法在结构完整性和输入拓扑上的不足,提升变形的稳定性和颜色一致性。

Comments Project page: https://baiyunshu.github.io/GAUSSIANMORPHING.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14782 2026-04-17 cs.CV 77%

One-shot Compositional 3D Head Avatars with Deformable Hair

单张图像生成可组合的3D头部化身与可变形头发

Yuan Sun, Xuan Wang, WeiLi Zhang, Wenxuan Zhang, Yu Guo, Fei Wang

机构 * Xi'an Jiaotong University(西安交通大学)

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文提出一种单张图像生成完整3D头部化身的方法,通过分离头发与面部区域,结合图像到3D提升技术,实现更逼真的头发动态和面部细节。

Comments project page: https://yuansun-xjtu.github.io/CompHairHead.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12217 2026-04-15 cs.GR 77%

VVGT: Visual Volume-Grounded Transformer

VVGT:视觉体素接地变换器

Yuxuan Wang, Qibiao Li, Youcheng Cai

专题命中 Gaussian Splatting :3DGS(abstract,abstract_cn);Gaussian Splatting(abstract);分类 cs.GR

AI总结 VVGT提出一种基于表示的体素可视化框架,通过直接映射体素数据到3D高斯点散布表示,实现高效、可扩展的体素可视化,支持多视角观测整合和零样本泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10951 2026-04-14 cs.RO 77%

Fast-SegSim: Real-Time Open-Vocabulary Segmentation for Robotics in Simulation

Fast-SegSim: 仿真中机器人快速开放词汇分割

Xuan Yu, Yuxuan Xie, Shichao Zhai, Shuhao Ye, Rong Xiong, Yue Wang

机构 * Zhejiang University(浙江大学)

专题命中 Gaussian Splatting :NeRF(abstract);Gaussian Splatting(abstract);3D reconstruction(abstract);分类 cs.RO

AI总结 本文提出Fast-SegSim,基于2D高斯散射构建端到端框架,实现高保真且3D一致的开放词汇分割重建。通过优化渲染管线和Top-K硬选择策略,提升渲染速度至40FPS以上,用于仿真平台传感器输入和下游感知任务的多视图地面真实标签生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10512 2026-04-14 cs.CV 77%

FreeScale: Scaling 3D Scenes via Certainty-Aware Free-View Generation

FreeScale: 通过置信度感知的自由视角生成实现3D场景扩展

Chenhan Jiang, Yu Chen, Qingwen Zhang, Jifei Song, Songcen Xu, Dit-Yan Yeung, Jiankang Deng

专题命中 Gaussian Splatting :3D vision(abstract);Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 FreeScale通过利用场景重建将有限的真实图像序列转化为高质量训练数据,通过置信度感知的自由视角采样策略提升NVS模型性能,实现2.7dB的PSNR提升。

Comments CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03309 2026-04-07 cs.CV cs.AI 77%

TreeGaussian: Tree-Guided Cascaded Contrastive Learning for Hierarchical Consistent 3D Gaussian Scene Segmentation and Understanding

TreeGaussian:基于树引导的级联对比学习用于层次一致的3D高斯场景分割与理解

Jingbin You, Zehao Li, Hao Jiang, Xinzhu Ma, Shuqin Gao, Honglong Zhao, Congcong Zheng, Tianlu Mao, Feng Dai, Yucheng Zhang, Zhaoqi Wang

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Beihang University(北京航空航天大学)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);point cloud(abstract);分类 cs.CV

AI总结 本文提出TreeGaussian,通过树引导的级联对比学习框架,解决3DGS在表示层次结构和捕捉整体-部分关系上的不足,提升分割一致性与质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02828 2026-04-06 cs.CV cs.AI 77%

NavCrafter: Exploring 3D Scenes from a Single Image

NavCrafter:从单张图像探索3D场景

Hongbo Duan, Peiyu Zhuang, Yi Liu, Zhengyang Zhang, Yuxin Zhang, Pengting Luo, Fangming Liu, Xueqian Wang

机构 * Center for Artificial Intelligence and Robotics, Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院人工智能与机器人中心) Peng Cheng Laboratory(鹏城实验室) School of Cyber Science and Technology, Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区网络空间安全学院) Central Media Technology Institute, Huawei Incorporated Company(华为技术有限公司中央媒体技术研究院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);3D reconstruction(abstract);分类 cs.CV

AI总结 NavCrafter通过合成新颖视角视频序列,实现从单张图像生成灵活的3D场景,采用视频扩散模型和几何感知扩展策略,提升可控多视角合成与3D重建精度。

Comments 8 pages accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06909 2026-03-30 cs.CV 77%

Gaussian Mapping for Evolving Scenes

高斯映射用于动态场景

Vladimir Yugay, Thies Kersten, Luca Carlone, Theo Gevers, Martin R. Oswald, Lukas Schmid

机构 * University of Amsterdam(阿姆斯特丹大学) University of Technology Nuremberg(纽伦堡工业大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);3DGS(abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 本文提出GaME方法,通过动态场景适应机制持续更新3DGS,结合新颖的关键帧管理机制,提升动态场景重建性能,在PSNR和L1深度误差上分别提升29.7%和3倍。

详情

展开后加载摘要…

URL PDF HTML 收藏