arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 4390 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 4390 篇

2606.17836 2026-06-17 cs.CV cs.AI cs.CG cs.GR 新提交 62%

High-Fidelity 3D Geometric Reconstruction of Pelvic Organs from MRI: A Hybrid Deep Learning and Iterative Optimization Approach

高保真盆腔器官MRI三维几何重建:一种混合深度学习与迭代优化方法

Hui Wang, Xiaowei Li, Chenxin Zhang, Yifan Feng, Jianwei Zuo, Yumeng Tang, Xiuli Sun, Jianliu Wang, Bing Xie, Jiajia Luo

机构 * Institute of Medical Technology, Peking University Health Science Center, Peking University(北京大学医学部医学技术研究院,北京大学) Biomedical Engineering Department, Institute of Advanced Clinical Medicine, Peking University(北京大学先进临床医学研究院生物医学工程系) Department of Obstetrics and Gynecology, Peking University People’s Hospital(北京大学人民医院妇产科部)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 提出混合可变形形状建模框架,结合深度学习预测与迭代优化,实现膀胱、子宫和直肠的高保真三维几何重建,在几何保真度和网格质量上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17480 2026-06-17 cs.CV cs.RO 新提交 62%

GeneralVLA-2: Geometry-Aware Reconstruction and Governed Memory for Robot Planning

GeneralVLA-2: 几何感知重建与受控记忆用于机器人规划

Haoyu Wang, Guoqing Ma, Zeyu Zhang, Yandong Guo, Boxin Shi, Hao Tang

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) CASIA(中国科学院自动化研究所) AI 2 Robotics

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 针对机器人规划中3D物体重建幻觉和记忆质量不可控的问题,提出GeoFuse-MV3D几何先验引导重建分支和受控长期记忆系统,在GSO-30和Terminal-Bench等基准上显著提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13655 2026-06-16 cs.CV cs.GR 新提交 62%

Flex4DHuman: Flexible Multi-view Video Diffusion for 4D Human Reconstruction

Flex4DHuman:面向4D人体重建的灵活多视角视频扩散模型

Jen-Hao Cheng, Yipeng Wang, Hao Zhang, Gengshan Yang, Jenq-Neng Hwang

机构 * University of Washington(华盛顿大学) World Labs

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 提出Flex4DHuman,一种基于相对相机位姿条件化的多视角视频扩散模型,无需显式几何先验即可将单目或稀疏多视角视频转换为密集多视角视频,并用于4D高斯溅射重建。

Comments Project Page: https://andy-cheng.github.io/Flex4DHuman/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07115 2026-06-08 cs.CV cs.GR 新提交 62%

3DMorph: Single-Image-Guided Local 3D Shape Editing and Morphing

3DMorph: 单图引导的局部3D形状编辑与变形

Tobias Preintner, Yunfei Deng, Phillip Müller, Sebastian Illing, Adrian König, Thomas Bäck, Elena Raponi, Niki van Stein

机构 * ETH Zürich(苏黎世联邦理工学院)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV、cs.GR

AI总结 提出无训练框架3DMorph,通过单张编辑图像自动定位并转移2D修改到3D局部区域,同时支持中间形状生成,在Delta3D基准上优于现有方法。

Comments Accepted to IJCNN 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22685 2026-06-08 eess.IV cs.CV cs.GR 版本更新 62%

VIRTUS-FPP: Virtual Sensor Modeling for Fringe Projection Profilometry in NVIDIA Isaac Sim

VIRTUS-FPP:NVIDIA Isaac Sim中条纹投影轮廓测量的虚拟传感器建模

Adam Haroon, Anush Lakshman, Badrinath Balasubramaniam, Beiwen Li

机构 * Department of Mechanical Engineering, Iowa State University(Iowa州立大学机械工程系) College of Engineering, University of Georgia(佐治亚大学工程学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 提出VIRTUS-FPP,首个在NVIDIA Isaac Sim中实现的端到端虚拟传感器建模框架,用于条纹投影轮廓测量,实现物理保真模拟,无需预校准物理系统,支持亚毫米级重建精度。

Comments 10 pages, 13 figures, accepted for publication in IEEE Sensors Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03994 2026-06-03 cs.CV cs.RO 62%

SimuScene: Simulation-Ready Compositional 3D Scene Reconstruction from a Single Image

SimuScene: 从单张图像重建仿真就绪的组合式3D场景

Inhee Lee, Sangwon Baik, Sungjoo Kim, Hyeonwoo Kim, Hyunsoo Cha, Hanbyul Joo

机构 * Seoul National University(首尔国立大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 提出SimuScene,一种将物理仿真融入形状和布局估计的组合式3D重建流水线,通过物理引擎诊断重建错误并驱动修正,生成稳定且仿真就绪的场景。

Comments Project Page: https://snuvclab.github.io/SimuScene/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00137 2026-06-02 cs.CV cs.GR 62%

Advances in Neural 3D Mesh Texturing: A Survey

神经3D网格纹理化进展:综述

Sai Raj Kishore Perla, Hao Zhang, Ali Mahdavi-Amiri

机构 * Simon Fraser University(西蒙弗雷泽大学)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV、cs.GR

AI总结 本文综述了神经3D网格纹理化的最新进展,涵盖纹理合成、迁移和补全方法,并提出了统一的分类体系。

Comments Eurographics STAR (Computer Graphics Forum), 2026. Project Page: https://sairajk.github.io/neural-mesh-texturing/

Journal ref Eurographics STAR (State of The Art Report), Computer Graphics Forum, Volume 45, Number 2, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00054 2026-06-02 cs.RO cs.AI cs.CV 62%

From Human Videos to Robot Manipulation: A Survey on Scalable Vision-Language-Action Learning with Human-Centric Data

从人类视频到机器人操作:基于人类中心数据的可扩展视觉-语言-动作学习综述

Zhiyuan Feng, Qixiu Li, Huizhi Liang, Rushuai Yang, Yichao Shen, Zhiying Du, Zhaowei Zhang, Yu Deng, Li Zhao, Hao Zhao, Zongqing Lu, Oier Mees, Marc Pollefeys, Jiaolong Yang, Baining Guo

机构 * Tsinghua University(清华大学) HKUST(香港科技大学) Xi’an Jiaotong University(西安交通大学) Fudan University(复旦大学) Microsoft Research Asia(微软亚洲研究院) Peking University(北京大学) Microsoft Zurich Project(微软苏黎世实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 本文综述了如何将丰富的人类视频转化为视觉-语言-动作(VLA)模型的有效知识,分类了四种方法(潜在动作表示、预测世界模型、显式2D监督、显式3D重建),并指出了结构化非结构化视频、跨具身和视角的动作映射、以及评估协议设计三大挑战。

Comments Accepted to IJCAI 2026 Survey Track. Project page: https://aaronfengzy.github.io/HumanCentricToVLA-Survey/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09877 2026-06-02 cs.CV cs.AI cs.RO 62%

Genie 4D: Semantic-Prior-Guided 4D Dynamic Scene Reconstruction

Genie 4D:语义先验引导的4D动态场景重建

Yiru Yang, Zhuojie Wu, Nishant Kumar Singh, Max Schulthess

机构 * University of Zurich(苏黎世大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV、cs.RO

AI总结 提出Genie 4D框架,结合实时视觉惯性高斯泼溅前端和前馈4D骨干网络,利用冻结的DINOv3特征作为结构先验抑制身份漂移,并通过条件扩散精炼器恢复高频细节,最终通过轻量级潜在动作头实现用户可控的4D世界模型重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08884 2026-06-02 cs.CV cs.AI cs.GR 62%

ShapeLib: Designing a library of programmatic 3D shape abstractions with Large Language Models

ShapeLib: 利用大型语言模型设计程序化3D形状抽象库

R. Kenny Jones, Paul Guerrero, Niloy J. Mitra, Daniel Ritchie

机构 * Stanford University(斯坦福大学) Adobe Research(Adobe研究) University College London(伦敦大学学院) Brown University(布朗大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV、cs.GR

AI总结 提出ShapeLib方法,利用大型语言模型的先验知识,通过引导式工作流自动设计可泛化的程序化3D形状抽象库,并支持下游形状编辑与生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30347 2026-05-29 cs.CV cs.GR 62%

NeuROK: Generative 4D Neural Object Kinematics

NeuROK:生成式4D神经物体运动学

Chen Geng, Guangzhao He, Yue Gao, Yunzhi Zhang, Shangzhe Wu, Jiajun Wu

机构 * Stanford University(斯坦福大学) University of Cambridge(剑桥大学) Cornell University(康奈尔大学)

专题命中 三维重建 :3D vision(abstract);分类 cs.CV、cs.GR

AI总结 提出基于Transformer的编码器-解码器模型NeuROK,通过学习物体潜在运动学参数化,实现从静态3D物体生成逼真的4D动态变形,克服了传统方法对预定义物理模型和特定类别的依赖。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26149 2026-05-27 cs.GR cs.CV 62%

AnySurf: Any Surface Generation with Directed Edge

AnySurf: 基于有向边的任意表面生成

Wenda Shi, Chenyuan Pan, Dengming Zhang, Yiren Song, Biao Zhang, Xingxing Zou

机构 * The Hong Kong Polytechnic University(香港理工大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) Xi'an Jiaotong University(西安交通大学)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV、cs.GR

AI总结 提出AnySurf统一框架,通过有向边增强的柔性双网格表示,实现开放、封闭和混合3D表面的高质量生成,并引入ROS-FT后训练和轻量级DE-Adapter以保持生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26113 2026-05-26 cs.RO cs.CV 62%

AnyScene: Towards Highly Controllable Driving Scene Generation at Anywhere and Beyond

AnyScene: 迈向高度可控的任意位置驾驶场景生成及超越

Haiming Zhang, Junfei Zhou, Feng Jiang, Jingzhong Li, Zhenglong Guo, Penglin Dai, Jifeng Dai, Yan Xie, Benjin Zhu

机构 * Li Auto(利汽车) Southwest Jiaotong University(西南交通大学) Tsinghua University(清华大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 提出AnyScene框架,通过时空占用扩散Transformer和几何引导视图扩展模块,实现从BEV布局生成语义占用序列和参考无关的多视角驾驶视频,支持精确可控和长时生成。

Comments Work in progress. Project page: https://mind-omni.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24642 2026-05-26 cs.CV cs.RO 62%

Understanding the Impact of Geometric Foundation Models on Vision-Language-Action Models

理解几何基础模型对视觉-语言-动作模型的影响

Yurou Yang, Muyuan Lin, Roberto Martin-Martin, Martin Labrie, Shreekant Gayaka, Cheng-Hao Kuo, Luca Carlone

机构 * Amazon Personal Robotics Group(亚马逊个人机器人小组) University of Texas at Austin(德克萨斯大学奥斯汀分校) Massachusetts Institute of Technology(麻省理工学院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 本文通过线性探测分析量化了视觉-语言-动作模型(VLA)与几何基础模型(GFM)之间的“几何差距”,比较了三种注入几何信息的架构,并研究了非架构因素对几何VLA性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18735 2026-05-19 cs.CV cs.GR cs.LG 62%

PIXLRelight: Controllable Relighting via Intrinsic Conditioning

PIXLRelight: 通过内在条件实现可控的图像重照明

Miguel Farinha, Ronald Clark

机构 * Department of Computer Science(计算机科学系) University of Oxford(牛津大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 PIXLRelight通过内在条件将物理基础渲染与学习图像合成相结合,实现对单图像重照明的可控性,其核心方法是利用真实照片或PBR渲染得到的内在条件进行训练和推理,从而在保证图像细节的同时实现高质量的重照明效果。

Comments Project page: https://mlfarinha.github.io/pixl-relight/. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18197 2026-05-19 cs.RO cs.AI cs.CV 62%

RGB-only Active 3D Scene Graph Generation for Indoor Mobile Robots

仅RGB的主动3D场景图生成用于室内移动机器人

Giorgia Modi, Davide Buoso, Giuseppe Averta, Daniele De Martini

机构 * Mobile Robotics Group (MRG)(移动机器人小组) Visual and Multimodal Applied Learning Lab (VANDAL)(视觉与多模态应用学习实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 本文提出了一种仅使用RGB输入的主动3D场景图生成方法,通过统一感知与规划的结构化表示,解决了传统方法对专用传感器的依赖问题,并在Replica数据集上验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18184 2026-05-19 cs.RO cs.AI cs.CV 62%

Fixed External Cameras as Common Prior Maps for Active 3D Scene Graph Generation

固定外部摄像头作为主动3D场景图生成的共同先验地图

Giorgia Modi, Davide Buoso, Giuseppe Averta, Daniele De Martini

机构 * Mobile Robotics Group (MRG)(移动机器人组) Visual and Multimodal Applied Learning Lab (VANDAL)(视觉与多模态应用学习实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 本文提出利用固定外部RGB摄像头作为共同先验地图,以实现主动、渐进式的3D场景图生成,通过融合机器人 onboard 摄像头和固定外部摄像头的数据,提高场景理解的效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16266 2026-05-19 cs.GR cs.CV cs.LG 62%

Patchwork: A compact representation for 3D polygonal shapes

Patchwork: 3D多边形形状的紧凑表示

Ruichen Zheng, Biao Zhang, Michael Birsak, Mikhail Skopenkov, Peter Wonka

机构 * King Abdullah University of Science and Technology(国王阿卜杜勒·阿齐兹大学)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV、cs.GR

AI总结 Patchwork提出了一种新的通用形状表示方法,通过少量参数建模2D和3D几何,提供可证明的复杂度界和任意精度近似能力,结合高效梯度优化和新型正则化损失,实现高紧凑性,适用于几何学习与重建任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13854 2026-05-15 cs.CV cs.GR cs.MM eess.IV 62%

Contrastive Multi-Modal Hypergraph Reasoning for 3D Crowd Mesh Recovery

对比多模态超图推理用于3D人群网格重建

Minghao Sun, Chongyang Xu, Yitao Xie, Buzhen Huang, Kun Li

机构 * Tianjin University(天津大学) Nanyang Technological University(南洋理工大学) Sichuan University(四川大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 本文提出对比多模态超图推理方法,结合语义、几何和姿态线索,解决人群重建中的遮挡和深度模糊问题,通过超图建模高阶人群动态,提升特征融合与跨模态正交性。

Comments ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05876 2026-05-14 cs.GR cs.CV 62%

3DSS: 3D Surface Splatting for Inverse Rendering

3DSS:用于逆渲染的3D表面散射

Mae Younes, Adnane Boukhayma

机构 * INRIA, University of Rennes(INRIA,里昂大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV、cs.GR

AI总结 3DSS通过基于覆盖的合成模型,结合微facet着色和HDR光照,实现了形状、BRDF材料和光照的联合恢复,适用于多视角图像的逆渲染。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09538 2026-05-12 cs.CV cs.AI cs.RO 62%

PhysHanDI: Physics-Based Reconstruction of Hand-Deformable Object Interactions

PhysHanDI: 基于物理的双手与可变形物体交互重建

Jihyun Lee, Changmin Lee, Donghwan Kim, Tae-Kyun Kim

机构 * School of Computing, KAIST, Daejeon, South Korea(韩国釜山科学技术院计算学系)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 PhysHanDI通过物理模拟实现双手与可变形物体的完整3D重建,结合密集重建的3D手部运动驱动物体变形,提升交互真实性和手部重建精度。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26694 2026-05-08 cs.RO cs.AI cs.CV 62%

Unified 4D World Action Modeling from Video Priors with Asynchronous Denoising

从视频先验构建统一的4D世界动作模型

Jun Guo, Qiwei Li, Peiyan Li, Zilong Chen, Nan Sun, Yifei Su, Heyun Wang, Yuan Zhang, Xinghang Li, Huaping Liu

机构 * Tsinghua University(清华大学) Xiaomi Robotics(小米机器人) Peking University(北京大学) CASIA

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 本文提出X-WAM,统一了实时机器人动作执行与高保真的4D世界合成,在单一框架中解决传统统一世界模型仅建模2D像素空间且无法平衡动作效率与世界建模质量的问题。

Comments Project website: https://sharinka0715.github.io/X-WAM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11349 2026-04-29 cs.CV cs.AI cs.GR 62%

Representation Paradigms in AI-based 3D Radiological Image Reconstruction: A Systematic Review

基于人工智能的3D放射学图像重建的表示范式:系统综述

Yuezhe Yang, Lei Bi, Boyu Yang, Yaqian Wang, Yang He, Yige Peng, Zhe Jin, Xingbo Dong, Jinman Kim

机构 * Biomedical Data Analysis and Visualisation (BDAV) Lab, School of Computer Science(生物医学数据与可视化实验室,计算机科学学院) Anhui Provincial International Joint Research Center for Advanced Technology in Medical Imaging, School of Artificial Intelligence(安徽省国际联合先进医学影像技术研究中心,人工智能学院) Institute of Translational Medicine, Shanghai Jiao Tong University(转化医学研究院,上海交通大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 本文综述了基于人工智能的3D放射学图像重建算法,按重建目标参数化方式分为四类表示方法,并讨论了当前发展、挑战及未来方向。

Comments 58 pages, Under Reivew

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14025 2026-04-16 cs.CV cs.AI cs.GR 62%

Feed-Forward 3D Scene Modeling: A Problem-Driven Perspective

前馈3D场景建模:以问题为导向的视角

Weijie Wang, Qihang Cao, Sensen Gao, Donny Y. Chen, Haofei Xu, Wenjing Bian, Songyou Peng, Tat-Jen Cham, Chuanxia Zheng, Andreas Geiger, Jianfei Cai, Jia-Wang Bian, Bohan Zhuang

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) Monash University(墨尔本大学) ETH Zurich(苏黎世联邦理工学院) University of Tübingen(图宾根大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 本文探讨了前馈3D重建的通用方法,提出以模型设计为核心的分类体系,涵盖特征增强、几何意识、模型效率等五个核心问题,旨在推动3D场景建模的标准化与可扩展性。

Comments 67 pages, 395 references. Project page: https://ff3d-survey.github.io. Code: https://github.com/ziplab/Awesome-Feed-Forward-3D. This work has been submitted to Springer for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01878 2026-04-10 cs.RO cs.CV cs.LG 62%

AI-Driven Marine Robotics: Emerging Trends in Underwater Perception and Ecosystem Monitoring

AI驱动的海洋机器人:水下感知与生态系统监测的新兴趋势

Scarlett Raine, Tobias Fischer

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 本文探讨了气候变暖背景下,AI在水下感知与生态系统监测中的应用发展,分析了环境需求、公民科学平台和研究人员迁移等因素推动的AI创新,展示了弱监督学习、开放集识别和鲁棒感知等技术的进展。

Comments 9 pages, 3 figures, Accepted for Oral Presentation at AAAI Conference on Artificial Intelligence 2026

Journal ref Proceedings of the AAAI Conference on Artificial Intelligence, 40 (2026), 40981-40989

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07350 2026-04-09 cs.CV cs.GR cs.LG 62%

Fast Spatial Memory with Elastic Test-Time Training

快速空间记忆与弹性测试时间训练

Ziqiao Ma, Xueyang Yu, Haoyu Zhen, Yuncong Yang, Joyce Chai, Chuang Gan

机构 * MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室) University of Michigan(密歇根大学) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 本文提出弹性测试时间训练方法,用于改进长上下文3D重建中的灾难性遗忘问题,通过引入弹性权重巩固,提升模型在处理任意长序列时的稳定性和适应性。

Comments Project Page: https://fast-spatial-memory.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18336 2026-04-08 cs.CV cs.GR 62%

PPISP: Physically-Plausible Compensation and Control of Photometric Variations in Radiance Field Reconstruction

PPISP: 光度变化在辐射场重建中的物理合理补偿与控制

Isaac Deutsch, Nicolas Moënne-Loccoz, Gavriel State, Zan Gojcic

机构 * NVIDIA(英伟达)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 本文提出PPISP模块,通过物理基础和可解释的转换分离相机固有和拍摄依赖效应,实现对多视角3D重建中光度不一致的合理补偿与控制,提升重建效果和评估公平性。

Comments For more details and updates, please visit our project website: https://research.nvidia.com/labs/sil/projects/ppisp/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05794 2026-04-08 cs.CV cs.GR 62%

EfficientMonoHair: Fast Strand-Level Reconstruction from Monocular Video via Multi-View Direction Fusion

EfficientMonoHair: 通过多视图方向融合实现单目视频中的高效发束重建

Da Li, Dominik Engel, Deng Luo, Ivan Viola

机构 * King Abdullah University of Science and Technology(阿卜杜拉国王科技大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV、cs.GR

AI总结 本文提出EfficientMonoHair框架,结合隐式神经网络与多视图几何融合,实现单目视频中高效准确的发束重建,通过融合补丁多视图优化和并行发生长策略提升效率与鲁棒性。

Comments 10 pages, 6 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05259 2026-04-08 cs.CV cs.RO 62%

Coverage Optimization for Camera View Selection

用于摄像头视角选择的覆盖优化

Timothy Chen, Adam Dai, Maximilian Adang, Grace Gao, Mac Schwager

机构 * Stanford University(斯坦福大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.RO

AI总结 本文提出了一种基于覆盖的摄像头视角选择方法,通过最小化鱼信息增益的近似值来选择信息丰富的视角,从而提高三维重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11109 2026-04-07 cs.CV cs.AI cs.GR 62%

Vision-as-Inverse-Graphics Agent via Interleaved Multimodal Reasoning

通过交错多模态推理的视觉-反图形代理

Shaofeng Yin, Jiaxin Ge, Zora Zhiruo Wang, Chenyang Wang, Xiuyu Li, Michael J. Black, Trevor Darrell, Angjoo Kanazawa, Haiwen Feng

机构 * University of California, Berkeley(加州大学伯克利分校) Carnegie Mellon University(卡内基梅隆大学) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) Impossible, Inc.(Impossible公司)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 本文提出VIGA框架,通过符号逻辑与视觉感知的交叉验证,解决视觉语言模型在单次设置中重建图像的挑战,支持2D文档生成、3D重建等任务。

Comments Project page: https://fugtemypt123.github.io/VIGA-website/

详情

展开后加载摘要…

URL PDF HTML 收藏