arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-03-06 至 2026-03-06 共收录 20 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 9 篇

2603.04847 2026-03-06 cs.CV cs.GR 88%

GloSplat: Joint Pose-Appearance Optimization for Faster and More Accurate 3D Reconstruction

GloSplat:面向更快速和更精确3D重建的联合姿态-外观优化

Tianyu Xiong, Rui Li, Linjie Li, Jiaqi Yang

机构 * Department of Computer Science, Northwestern Polytechnical University, Shanxi, China(计算机科学系,西北工业大学,山西,中国)

专题命中 三维重建 :3D reconstruction(title);NeRF(abstract);Gaussian Splatting(abstract);3DGS(abstract)

AI总结 GloSplat通过联合姿态-外观优化提升3D重建速度和精度,提供无COLMAP和详尽匹配两种变体,实现高效且高质量的重建效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04179 2026-03-06 cs.CV 83%

NOVA3R: Non-pixel-aligned Visual Transformer for Amodal 3D Reconstruction

NOVA3R:非像素对齐的视觉变换器用于模态3D重建

Weirong Chen, Chuanxia Zheng, Ganlin Zhang, Andrea Vedaldi, Daniel Cremers

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心) University of Oxford(牛津大学) Nanyang Technological University(南洋理工大学)

专题命中 三维重建 :3D reconstruction(title,abstract);point cloud(abstract);分类 cs.CV

AI总结 NOVA3R通过非像素对齐的视觉变换器实现更准确的3D重建,解决了传统像素对齐方法在处理可见和不可见点及重叠区域结构上的局限。

Comments Accepted to ICLR 2026. Project Page: https://wrchen530.github.io/nova3r

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24096 2026-03-06 cs.CV cs.AI cs.LG 70%

DiffusionHarmonizer: Bridging Neural Reconstruction and Photorealistic Simulation with Online Diffusion Enhancer

DiffusionHarmonizer: 通过在线扩散增强器连接神经重建与逼真模拟

Yuxuan Zhang, Katarína Tóthová, Zian Wang, Kangxue Yin, Haithem Turki, Riccardo de Lutio, Yen-Yu Chang, Or Litany, Sanja Fidler, Zan Gojcic

机构 * NVIDIA University of Toronto(多伦多大学) Cornell University(康奈尔大学) Technion(技术学院)

专题命中 三维重建 :NeRF(abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 DiffusionHarmonizer通过在线扩散增强器提升神经重建与逼真模拟的结合,解决动态物体整合与伪影问题,提高模拟保真度。

Comments For more details and updates, please visit our project website: https://research.nvidia.com/labs/sil/projects/diffusion-harmonizer

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13454 2026-03-06 cs.CV 70%

Text-to-3D by Stitching a Multi-view Reconstruction Network to a Video Generator

通过将多视角重建网络缝合到视频生成器中实现文本到3D

Hyojun Go, Dominik Narnhofer, Goutam Bhat, Prune Truong, Federico Tombari, Konrad Schindler

机构 * ETH Zurich(苏黎世联邦理工学院) Google(谷歌)

专题命中 三维重建 :3D reconstruction(abstract);3D generation(abstract);分类 cs.CV

AI总结 VIST3A通过将多视角重建网络缝合到视频生成器中,实现文本到3D生成,提升3D场景生成质量。

Comments ICLR 2026 (Oral), Project page: https://gohyojun15.github.io/VIST3A/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05449 2026-03-06 cs.CV cs.AI cs.GR 62%

RealWonder: Real-Time Physical Action-Conditioned Video Generation

RealWonder: 基于实时物理动作的视频生成

Wei Liu, Ziyu Chen, Zizhang Li, Yue Wang, Hong-Xing Yu, Jiajun Wu

机构 * Stanford University(斯坦福大学) University of Southern California(南加州大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV、cs.GR

AI总结 RealWonder通过物理模拟实现实时动作条件视频生成,利用3D重建、物理模拟和简化视频生成器,在单张图像基础上生成高质量视频,适用于多种物理场景。

Comments The first two authors contributed equally. The last two authors advised equally. Project website: https://liuwei283.github.io/RealWonder/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05506 2026-03-06 cs.CV 57%

FaceCam: Portrait Video Camera Control via Scale-Aware Conditioning

FaceCam: 通过尺度感知条件化实现人像视频相机控制

Weijie Lyu, Ming-Hsuan Yang, Zhixin Shu

机构 * University of California, Merced(加州大学梅尔塞德斯分校) Adobe Research(Adobe研究)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 FaceCam通过尺度感知条件化方法,提升单目人像视频的相机控制能力与视觉质量。

Comments Accepted by CVPR 2026. Project page: https://weijielyu.github.io/FaceCam

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05312 2026-03-06 cs.RO 57%

UltraDexGrasp: Learning Universal Dexterous Grasping for Bimanual Robots with Synthetic Data

UltraDexGrasp: 为双臂机器人学习通用灵巧抓取

Sizhe Yang, Yiman Xie, Zhixuan Liang, Yang Tian, Jia Zeng, Dahua Lin, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学) The University of Hong Kong(香港大学) Peking University(北京大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 UltraDexGrasp通过合成数据训练出高效抓取策略,实现双臂机器人在多种物体上的高成功率抓取。

Comments Published at International Conference on Robotics and Automation (ICRA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04614 2026-03-06 cs.CV 57%

SGR3 Model: Scene Graph Retrieval-Reasoning Model in 3D

SGR3模型:三维场景图检索-推理模型

Zirui Wang, Ruiping Liu, Yufan Chen, Junwei Zheng, Weijia Fan, Kunyu Peng, Di Wen, Jiale Wei, Jiaming Zhang, Rainer Stiefelhagen

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Shenzhen University(深圳大学) Hunan University(湖南大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 SGR3模型通过多模态大语言模型与检索增强生成技术,实现无需训练的三维场景图生成,提升场景关系推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19854 2026-03-06 cs.CV 57%

STAvatar: Soft Binding and Temporal Density Control for Monocular 3D Head Avatars Reconstruction

STAvatar: 基于软绑定与时间密度控制的单目3D头部人偶重建

Jiankuo Zhao, Xiangyu Zhu, Zidu Wang, Zhen Lei

机构 * MAIS, Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) CAIR, HKISI, Chinese Academy of Sciences(中国科学院计算技术研究所) SCSE, FIE, M.U.S.T(M.U.S.T)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 STAvatar通过软绑定与时间密度控制方法,实现了单目视频中高保真3D头部人偶的重建,尤其在细粒度细节和遮挡区域的重建上表现优异。

Comments Accepted to CVPR 2026. Project page: https://jiankuozhao.github.io/STAvatar/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 1 篇

2603.05473 2026-03-06 cs.CV 57%

Towards 3D Scene Understanding of Gas Plumes in LWIR Hyperspectral Images Using Neural Radiance Fields

利用神经辐射场实现L波段超光谱图像中气体云三维场景理解

Scout Jarman, Zigfried Hampel-Arias, Adra Carr, Kevin R. Moon

机构 * Utah State University, Department of Mathematics & Statistics(犹他州立大学数学与统计学系) Los Alamos National Laboratory, Intelligence and Space Research Division(洛斯阿拉莫斯国家实验室情报与空间研究部)

专题命中 NeRF :NeRF(abstract);分类 cs.CV

AI总结 本文提出一种基于神经辐射场的三维场景重建方法,利用较少训练图像实现气体云检测,提升L波段超光谱图像中气体云的分析能力。

Comments This manuscript was submitted to SPIE JARS and is under review. Code and Data can be found at https://github.com/lanl/HSI-Nerfstudio and https://zenodo.org/records/18626884 respectively. Video 1 and Video 2 can be found at https://github.com/lanl/HSI-Nerfstudio/blob/main/renders/paper/grid_Falsecolor.mp4 and https://github.com/lanl/HSI-Nerfstudio/blob/main/renders/paper/grid_ACE.mp4 respectively

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 4 篇

2603.05152 2026-03-06 cs.CV cs.AI cs.GR 86%

SSR-GS: Separating Specular Reflection in Gaussian Splatting for Glossy Surface Reconstruction

SSR-GS:在高光表面重建中分离镜面反射

Ningjing Fan, Yiqun Wang

机构 * Chongqing University(重庆大学)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);novel view synthesis(abstract);分类 cs.CV、cs.GR

AI总结 SSR-GS通过引入预过滤Mip-Cubemap和IndiASG模块,结合视觉几何先验,有效分离镜面反射,提升高光表面重建性能。

Comments Project page: https://gsflyer.github.io/SSR-GS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18140 2026-03-06 cs.RO cs.CV cs.LG 84%

Observer-Actor: Active Vision Imitation Learning with Sparse-View Gaussian Splatting

观察者-执行者:基于稀疏视角高斯点云的主动视觉模仿学习

Yilong Wang, Cheng Qian, Ruomeng Fan, Edward Johns

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);3DGS(abstract);分类 cs.CV、cs.RO

AI总结 ObAct通过主动视觉探索提升双臂机器人模仿学习的鲁棒性,利用稀疏视角高斯点云增强观测清晰度,实验显示其在无遮挡和有遮挡情况下均显著优于固定相机设置。

Comments Accepted at ICRA 2026. Project Webpage: https://obact.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05108 2026-03-06 cs.RO 79%

GaussTwin: Unified Simulation and Correction with Gaussian Splatting for Robotic Digital Twins

GaussTwin: 基于高斯点播的统一仿真与校正用于机器人数字孪生

Yichen Cai, Paul Jansonnie, Cristiana de Farias, Oleg Arenz, Jan Peters

机构 * Intelligent Autonomous Systems Lab, Technical University of Darmstadt(德累斯顿技术大学智能自主系统实验室) German Research Center for AI (DFKI), SAIROL(德国人工智能研究中心(DFKI)SAIROL) Robotics Institute Germany (RIG)(德国机器人研究所) NAVER LABS Europe(NAVER LABS欧洲)

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.RO

AI总结 GaussTwin通过结合物理仿真与高斯点播技术,实现了稳定且真实的数字孪生,提升了机器人操作的跟踪精度和鲁棒性,并支持闭环交互与学习。

Comments 8 pages, 4 figures, 3 tables, ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04770 2026-03-06 cs.CV cs.AI 79%

DSA-SRGS: Super-Resolution Gaussian Splatting for Dynamic Sparse-View DSA Reconstruction

DSA-SRGS:动态稀疏视图DSA重建的超分辨率高斯散射

Shiyu Zhang, Zhicong Wu, Huangxuan Zhao, Zhentao Liu, Lei Chen, Yong Luo, Lefei Zhang, Zhiming Cui, Ziwen Ke, Bo Du

机构 * School of Computer Science, Wuhan University, Wuhan, China (S. Zhang), (Z. Wu), (H. Zhao), (Y. Luo), (L. Zhang), (B. Du) School of Biomedical Engineering \& State Key Laboratory of Advanced Medical Materials Devices, ShanghaiTech University, Shanghai, China (Z. Liu), (Z. Cui), (Z. Ke) Union Hospital, Tongji Medical College, Huazhong University of Science School of Computer Science, Wuhan University, Wuhan, China Institute of Artificial Intelligence, Xiamen University, Xiamen, China School of Biomedical Engineering \& State Key Laboratory of Advanced Medical Materials Devices, ShanghaiTech University, Shanghai, China Union Hospital, Tongji Medical College, Huazhong University of Science

专题命中 Gaussian Splatting :Gaussian Splatting(title,abstract);分类 cs.CV

AI总结 DSA-SRGS通过多保真度纹理学习和辐射子像素致密化,实现了动态稀疏视图DSA重建的超分辨率高斯散射,提升血管细节和分支结构的重建精度。

Comments 11 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 4 篇

2603.05111 2026-03-06 cs.RO cs.AI 57%

SPIRIT: Perceptive Shared Autonomy for Robust Robotic Manipulation under Deep Learning Uncertainty

SPIRIT:基于深度学习不确定性的感知共享自主控制以实现稳健的机器人操作

Jongseok Lee, Ribin Balachandran, Harsimran Singh, Jianxiang Feng, Hrishik Mishra, Marco De Stefano, Rudolph Triebel, Alin Albu-Schaeffer, Konstantin Kondak

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 SPIRIT通过结合深度学习的不确定性估计与触觉遥控,实现安全稳健的机器人操作,提升性能与可靠性。

Comments 19 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05017 2026-03-06 cs.RO 57%

Direct Contact-Tolerant Motion Planning With Vision Language Models

直接接触容忍的运动规划与视觉语言模型

He Li, Jian Sun, Chengyang Li, Guoliang Li, Qiyu Ruan, Shuai Wang, Chengzhong Xu

机构 * State Key Laboratory of Internet of Things for Smart City (SKL-IOTSC), University of Macau(物联网智能城市国家重点实验室,澳门大学) Shenzhen Institutes of Advanced Technology (SIAT), Chinese Academy of Sciences(深圳先进技术研究院,中国科学院) Department of Electrical and Computer Engineering, The University of Hong Kong(香港大学电子与计算机工程系)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 本文提出直接接触容忍运动规划方法,利用视觉语言模型实现接触感知导航,提升机器人在拥挤环境中的鲁棒性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06068 2026-03-06 cs.RO cs.AI 57%

MachaGrasp: Morphology-Aware Cross-Embodiment Dexterous Hand Articulation Generation for Grasping

MachaGrasp:基于形态的跨躯体灵巧手关节生成方法用于抓取

Heng Zhang, Kevin Yuchen Ma, Mike Zheng Shou, Weisi Lin, Yan Wu

机构 * Robotics & Autonomous Systems Division, Institute for Infocomm Research, Agency for Science, Technology and Research (A*STAR-I 2 R)(机器人与自主系统 division,信息通信研究所,科技研究局) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) Show Lab, National University of Singapore(Show Lab,国立新加坡大学)

专题命中 点云 :point cloud(abstract);分类 cs.RO

AI总结 MachaGrasp提出一种基于形态的跨躯体灵巧手抓取生成方法,通过形态嵌入和特征抓取集生成抓取动作,实现高成功率的抓取任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04683 2026-03-06 cs.LG 50%

Direct Estimation of Tree Volume and Aboveground Biomass Using Deep Regression with Synthetic Lidar Data

利用合成激光雷达数据进行树体积和地上生物量的直接估计

Habib Pourdelan, Zhengkang Xiang, Hugh Stewart, Cam Nicholson, Martin Tomko, Kourosh Khoshelham

机构 * The University of Melbourne(墨尔本大学) Private Forestry Service Victoria(维多利亚私人林业服务) Nicon Rural Services(Nicon乡村服务)

专题命中 点云 :point cloud(abstract)

AI总结 本研究提出利用合成激光雷达数据训练深度回归网络,直接估算森林体积和地上生物量,相较传统方法更准确高效。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 新视角合成 1 篇

2510.13063 2026-03-06 cs.CV cs.AI cs.LG 79%

True Self-Supervised Novel View Synthesis is Transferable

真正的自监督新视角合成是可迁移的

Thomas W. Mitchel, Hyunwoo Ryu, Vincent Sitzmann

机构 * Adobe, PlayStation(Adobe公司、PlayStation) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

专题命中 新视角合成 :novel view synthesis(title,abstract);分类 cs.CV

AI总结 本文提出XFactor,首个无需几何的自监督模型,实现真正的新视角合成并通过无约束潜在姿态变量实现可迁移性。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 其他3D视觉 1 篇

2603.05159 2026-03-06 cs.CV eess.IV 57%

Generic Camera Calibration using Blurry Images

使用模糊图像进行通用相机校准

Zezhun Shi

机构 * Independent Researcher(独立研究者)

专题命中 其他3D视觉 :3D vision(abstract);分类 cs.CV

AI总结 本文提出了一种利用模糊图像进行通用相机校准的方法,通过几何约束和局部照明模型同时估计特征位置和点扩散函数,有效解决平移模糊问题。

详情

展开后加载摘要…

URL PDF HTML 收藏