arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 4393 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 4393 篇

2506.08635 2025-06-11 cs.CV 61%

SurfR: Surface Reconstruction with Multi-scale Attention

Siddhant Ranade, Gonçalo Dias Pais, Ross Tyler Whitaker, Jacinto C. Nascimento, Pedro Miraldo, Srikumar Ramalingam

专题命中 三维重建 :point cloud(abstract);分类 cs.CV;3D vision(journal_ref)

Comments Accepted in 3DV 2025

Journal ref International Conference on 3D Vision 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13426 2025-03-04 cs.CV 61%

HMD^2: Environment-aware Motion Generation from Single Egocentric Head-Mounted Device

Vladimir Guzov, Yifeng Jiang, Fangzhou Hong, Gerard Pons-Moll, Richard Newcombe, C. Karen Liu, Yuting Ye, Lingni Ma

专题命中 三维重建 :point cloud(abstract);分类 cs.CV;3D vision(comments)

Comments International Conference on 3D Vision 2025 (3DV 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08086 2024-08-16 cs.CV 61%

Single-image coherent reconstruction of objects and humans

Sarthak Batra, Partha P. Chakrabarti, Simon Hadfield, Armin Mustafa

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV;3D generation(comments)

Comments Accepted at AI for 3D Generation, CVPR Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.04776 2024-07-22 cs.CV 61%

Self-supervised Depth Denoising Using Lower- and Higher-quality RGB-D sensors

Akhmedkhan Shabanov, Ilya Krotov, Nikolay Chinaev, Vsevolod Poletaev, Sergei Kozlukov, Igor Pasechnik, Bulat Yakupov, Artsiom Sanakoyeu, Vadim Lebedev, Dmitry Ulyanov

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV;3D vision(journal_ref)

Journal ref 2020 International Conference on 3D Vision (3DV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.14485 2023-10-31 cs.CV 61%

FastHuman: Reconstructing High-Quality Clothed Human in Minutes

Lixiang Lin, Songyou Peng, Qijun Gan, Jianke Zhu

专题命中 三维重建 :point cloud(abstract);分类 cs.CV;3D vision(comments)

Comments International Conference on 3D Vision, 3DV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.08932 2022-08-19 cs.CV stat.ML 61%

ManiFlow: Implicitly Representing Manifolds with Normalizing Flows

Janis Postels, Martin Danelljan, Luc Van Gool, Federico Tombari

专题命中 三维重建 :point cloud(abstract);分类 cs.CV;3D vision(comments)

Comments International Conference on 3D Vision 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.15510 2022-07-08 cs.CV 61%

ESL: Event-based Structured Light

Manasi Muglikar, Guillermo Gallego, Davide Scaramuzza

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV;3D vision(journal_ref)

Journal ref IEEE International Conference on 3D Vision (3DV), 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.07937 2022-01-21 cs.CV 61%

GASCN: Graph Attention Shape Completion Network

Haojie Huang, Ziyi Yang, Robert Platt

专题命中 三维重建 :point cloud(abstract);分类 cs.CV;3D vision(comments)

Comments International Conference on 3D Vision (3DV)

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.00703 2020-06-03 cs.CV cs.LG eess.IV 61%

Learned Semantic Multi-Sensor Depth Map Fusion

Denys Rozumnyi, Ian Cherabier, Marc Pollefeys, Martin R. Oswald

专题命中 三维重建 :3D reconstruction(abstract,comments);分类 cs.CV

Comments 11 pages, 7 figures, 2 tables, accepted for the 2nd Workshop on 3D Reconstruction in the Wild (3DRW2019) in conjunction with ICCV2019

Journal ref 2019 IEEE/CVF International Conference on Computer Vision Workshop (ICCVW)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18005 2026-08-19 cs.CV 版本更新 57%

UrbanWorld2.0: A Multimodal Agentic Framework for Reality-Aligned 3D World Generation at City-Scale

RAISECity: 一种用于城市级现实对齐3D世界生成的多模态代理框架

Shengyuan Wang, Zhiheng Zheng, Yu Shang, Lixuan He, Yangcheng Yu, Fan Hangyu, Jie Feng, Qingmin Liao, Yong Li

机构 * College of AI, Tsinghua University(人工智能学院,清华大学) Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学) Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系,北京研究院,清华大学)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 RAISECity通过多模态代理框架实现城市级3D世界生成,提升现实对齐、精度和性能,适用于沉浸媒体和具身智能应用。

Comments Accepted by ACM MM 2026, the code is available at: https://github.com/tsinghua-fib-lab/UrbanWorld2.0

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16725 2026-08-18 cs.CV cs.AI 新提交 57%

Unsupervised Anomaly Detection for Image Dataset Quality Assurance in Multi-Center Breast MRI

面向多中心乳腺MRI图像数据集质量保证的无监督异常检测

Chiara Tappermann, Steffen Renisch, Lars Ole Schwen, Hans Meine, Horst K. Hahn, Eike Petersen

机构 * Cambridge University Hospitals(剑桥大学医院) Mitera Hospital(米特拉医院) Radboud University Medical Center(拉德堡德大学医学中心) University Hospital Aachen(亚琛大学医院) University Medical Center Utrecht(乌得勒支大学医学中心) Ribera Hospital(里贝拉医院) Duke Breast Cancer MRI(杜克乳腺癌磁共振成像项目)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 该研究针对多中心乳腺MRI数据集,构建含17种异常类型的无监督异常检测基准,评估四种方法,发现带位置编码的投影法性能最优,为医疗AI的可扩展无监督质量保证提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15251 2026-08-18 cs.CV 新提交 57%

Robust structure from motion for aerial-ground images via detector-free feature matching and multi-view track refinement

基于无检测器特征匹配与多视图轨迹优化的空地图像鲁棒运动恢复结构

San Jiang, Hui Wang, Xing Zhang, Zhongwen Hu, Zhijun Wang, Ruisheng Wang, Wanshou Jiang, Qingquan Li

机构 * School of Architecture and Urban Planning, Shenzhen University(深圳大学建筑与城市规划学院) Guangdong Key Laboratory of Urban Informatics, Shenzhen University(深圳大学广东省城市信息学重点实验室) MNR Key Laboratory for Geo-Environmental Monitoring of Great Bay Area, Shenzhen University(深圳大学自然资源部大湾区地理环境监测重点实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本研究提出结合无检测器匹配网络与多视图轨迹优化的方法,用于解决空地图像三维重建中特征匹配鲁棒性问题,在5°位姿误差下AUC较LoFTR提升93.9%,实现更高精度的ISfM重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26182 2026-08-18 cs.AI cs.GR 版本更新 57%

BrickAnything: Geometry-Conditioned Buildable Brick Generation with Structure-Aware Tokenization

BrickAnything: 基于几何条件的可构建砖块生成与结构感知标记化

Zhengyang Ni, Feng Yan, Yu Guo, Fei Wang

机构 * Xi’an Jiaotong University(西安交通大学) State Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家重点实验室) Institute of Artificial Intelligence and Robotics(人工智能与机器人研究院)

专题命中 三维重建 :point cloud(abstract);分类 cs.GR

AI总结 提出BrickAnything,一个基于几何条件的自回归框架,通过结构感知树标记化生成满足装配约束和结构稳定性的砖块结构。

Comments Revised version with updated Code: https://github.com/xjtunzy/BrickAnything

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14138 2026-08-17 cs.CV cs.AI 新提交 57%

SPARGen: Unifying Spatial Perception and Reasoning through Native Multimodal Generation

SPARGen:通过原生多模态生成统一空间感知与推理

Jinsheng Quan, Jianhua Li, Siyi Xie, Xuanke Shi, Kewang Deng, Zukai Chen, Feifei Shao, Lei Yang, Quan Wang, Yawei Luo

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 SPARGen是统一多模态框架,将3D重建等空间任务转为指令条件生成任务,在单一框架内实现异构空间任务的竞争力性能,突破现有方法的知识迁移限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02075 2026-08-17 cs.CV 版本更新 57%

HandsOnWorld: Unconstrained Egocentric Video Generation with Camera-Disentangled Hand Control

HandsOnWorld: 无约束的自我中心视频生成,具有相机解耦的手部控制

Yushuo Chen, Xiaoyu Shi, Xiaoshi Wu, Xintao Wang, Pengfei Wan, Yebin Liu

机构 * Tsinghua University(清华大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队) Chinese University of Hong Kong(香港中文大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出HandsOnWorld框架,通过单目重建从无约束视频中学习手部控制,利用Plücker手部映射解耦相机与手部运动,生成高保真自我中心视频。

Comments Project Page: https://shad0wta9.github.io/handsonworld-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11729 2026-08-14 cs.CV cs.LG 版本更新 57%

SpaRRTa: A Synthetic Benchmark for Evaluating Spatial Intelligence in Visual Foundation Models

SpaRRTa:用于评估视觉基础模型空间智能的合成基准

Turhan Can Kargin, Wojciech Jasiński, Adam Pardyl, Bartosz Zieliński, Marcin Przewięźlikowski

机构 * AGH University of Krakow(克拉科夫AGH大学) IDEAS NCBR

专题命中 三维重建 :spatial understanding(abstract);分类 cs.CV

AI总结 SpaRRTa通过评估视觉基础模型的空间推理能力,揭示其在不同空间任务中的表现差异,旨在推动更高效的空间意识视觉模型发展。

Comments Project page is available at https://sparrta.gmum.net/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12232 2026-08-13 cs.CV 新提交 57%

ScaleVid: Geometry-Aware Video Object Scaling with Mesh-Free Inference

ScaleVid:基于无网格推理的几何感知视频目标缩放

Youze Huang, Penghui Ruan, Bojia Zi, Xianbiao Qi, Shihao Zhao, Rong Xiao

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 ScaleVid提出无网格推理的两阶段训练框架,实现几何感知视频目标缩放,在野外视频评估中,其几何一致性、前景保真度等优于需显式3D重建的方法,推理更实用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11409 2026-08-13 cs.RO 新提交 57%

From Self-Normal-Positioning to Omni-Directional Tracking: Real-Time Surface Modeling Enabled Probe Tilt Control for Robotic Ultrasound Imaging

从自正常定位到全向跟踪:用于机器人超声成像的实时表面建模支持的探头倾斜控制

Xihan Ma, Haichong Zhang

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 该研究针对机器人超声成像中现有系统仅支持探头法向定位的局限,提出整合RGB-D感知等的全向探头朝向控制框架,实现了高精度的任意角度跟踪,可获取临床所需非法向诊断视图。

Comments 10 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14615 2026-08-13 cs.CV 版本更新 57%

CalibAnyView: Beyond Single-View Camera Calibration in the Wild

CalibAnyView:超越单视角相机校准的野外应用

Boying Li, Cheng Zhang, Weirong Chen, Guyuan Chen, Daniel Cremers, Jianfei Cai, Ian Reid, Hamid Rezatofighi

机构 * Monash University(蒙纳士大学) Technical University of Munich(慕尼黑技术大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 CalibAnyView通过多视角几何一致性建模,提升野外多视角相机校准的鲁棒性和精度,适用于复杂场景下的3D重建和机器人感知。

Comments 27 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10888 2026-08-12 cs.CV 新提交 57%

Sensor-Informed Per-Point Covariance for Structured-Light 3D Imaging

面向结构光三维成像的传感器感知逐点协方差

Sehoon Tak, Jae-Sang Hyun

机构 * Yonsei University(延世大学) Yonsei Institute for Embodied Intelligence(延世具身智能研究所)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文针对结构光三维成像中逐点协方差未反映测量过程的问题,提出传感器感知一阶方法构建逐点3×3协方差场,实验验证其在G-ICP配准中性能优于各向同性模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09778 2026-08-11 cs.RO 新提交 57%

RoboSeg: Online Part-Level Semantic Reconstruction for Robotic Manipulation via a Single Eye-in-Hand Camera

RoboSeg:基于单眼在手相机的机器人操作的在线部件级语义重建

Zhaochen Lan, Mengxiang Lin

机构 * School of Mechanical Engineering and Automation, Beihang University(北京航空航天大学机械工程及自动化学院)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 RoboSeg是无需CAD模型的部件级语义重建系统,结合VLM、TSDF融合与SAM3,实现机器人操作的部件语义索引,在24次物理试验中21次完成综合任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08476 2026-08-11 cs.CV 新提交 57%

RayLift: Lifting Complementary Ray-Wise Evidence with 3D Geometry Priors for Semantic Scene Completion

RayLift:利用3D几何先验提升互补射线级证据以实现语义场景补全

Meng Wang, Hongxia Yu, Wenzhe He, Xingdong Song, Huilong Pi, Jiapeng Zhang, Ruihui Li

专题命中 三维重建 :3D vision(abstract);分类 cs.CV

AI总结 针对现有语义场景补全方法的深度误差传播问题,提出RayLift框架,通过互补上下文编码器、深度射线证据提升模块和语义感知体素集成器,在两个基准数据集上实现优于现有方法的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07559 2026-08-11 cs.CV cs.LG 新提交 57%

MVMD: A Multi-View Approach for Enhanced Mirror Detection

MVMD:用于增强镜面检测的多视图方法

Yidan Shen, Yu Wen, Chen Zhang, Xin Fu, Renjie Hu

机构 * University of Houston(休斯顿大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对现有镜面检测仅关注单图像的局限,提出多视图镜面检测方法MVMD及首个多视图镜面检测数据库,通过三个模块提升检测效果,使准确率和IoU分别最高提升2.6%和11.1%,增强了镜面密集环境下的三维重建准确性。

Comments This work has already published at WACV 2025, just want more accessibility

Journal ref 2025 IEEE/CVF Winter Conference on Applications of Computer Vision (WACV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08813 2026-08-11 cs.RO 版本更新 57%

Calib3R: Hand-Eye Calibration and 3D Metric-Scaled Scene Reconstruction with 3D Foundation Models

Calib3R:基于三维基础模型的手眼标定与三维度量尺度场景重建

Davide Allegro, Matteo Terreran, Stefano Ghidoni

机构 * Department of Information Engineering (DEI) at the University of Padova(帕多瓦大学信息工程系)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 Calib3R是一种基于3D基础模型的无标定板方法,通过统一优化联合完成手眼标定与度量尺度三维重建,仅用不到10张图像即可实现精确标定,性能优于同类方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06599 2026-08-10 cs.CV cs.ET 新提交 57%

Toward surface-based registration of a virtual preoperative cutting guide onto the mandible for reconstruction surgery

面向虚拟术前切割导板与下颌骨的基于表面的配准技术用于重建手术

Yue Yang, Jie Ying Wu

机构 * Vanderbilt University(范德堡大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 该研究提出一种无标记AR方案,通过扩展表面配准技术实现虚拟切割导板与术中暴露下颌骨的配准,经测试其配准误差与延迟支持替代物理打印导板的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06208 2026-08-07 cs.RO 新提交 57%

ErgoSurf: Ergodic Control for the Coverage of Unknown Surfaces

ErgoSurf:用于未知表面覆盖的遍历控制

Stefan Schneyer, Timo Bachmann, Maged Iskandar, Korbinian Nottensteiner, Alin Albu-Schäffer, Freek Stulp, João Silvério

机构 * German Aerospace Center (DLR)(德国航空航天中心) Technical University of Munich (TUM)(慕尼黑工业大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 提出ErgoSurf框架,结合GPIS模型与触觉传感,实现未知表面的遍历覆盖与几何在线学习,经仿真和真实机器人实验验证有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06923 2026-08-07 cs.CV 版本更新 57%

Bi-PT: Bidirectional Cross-Attention Point Transformers for Four-Chamber Heart Reconstruction from Sparse Cardiac MRI Data

Bi-PT:用于从稀疏心脏MRI数据重建四腔心的双向交叉注意力点变换器

Chenchuhui Hu, Shaoming Pan, Leon Axel, Meng Ye

机构 * University of Texas at Arlington(德克萨斯大学阿灵顿分校) New York University(纽约大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 针对从稀疏心脏MRI数据重建四腔心的问题,Bi-PT通过双向点交叉注意力学习点特征,结合逐点语义标签改进对应估计,将变形场公式化为神经常微分方程,集成语义标签损失和添加平滑正则化,实验证明其性能准确且稳健。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05066 2026-08-06 cs.CV 新提交 57%

Beyond Reprojection Error: Camera Calibration with 3D Targets

超越重投影误差:基于3D靶标的相机标定

Dennis Ruppel, Hasan Kutlu, Kai A. Neumann, Martin Knuth, Pedro Santos, Andreas Weinmann, Arjan Kuijper

机构 * Fraunhofer Institute for Computer Graphics Research(弗劳恩霍夫计算机图形研究所) Technical University of Applied Sciences Würzburg-Schweinfurt(维尔茨堡-施韦因富特应用技术大学) Technical University Darmstadt(达姆施塔特工业大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本研究针对三维重建提出基于场景射线预测的相机标定框架,采用重建与相交误差等指标,设计二十面体标定靶标,提升了标定精度,发现重投影误差可能误导三维精度评估。

Comments 16 pages, 7 figures, 2 tables. To appear in the proceedings of Computer Graphics International (CGI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04210 2026-08-06 cs.CV 新提交 57%

PADFormer: Pose-agnostic Anomaly Detection from Sparse View Images

PADFormer:基于稀疏视角图像的姿态无关异常检测

Ruiqi Wang, Yiming Qian, Fenggen Yu, Yuxuan Lu, Dakuo Wang, Hao Zhang, Jing Huang

机构 * Amazon(亚马逊) Simon Fraser University(西蒙菲莎大学) Northeastern University(东北大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对现有姿态无关异常检测方法依赖3D重建的缺陷,提出PADFormer模型,利用ViT结合跨视图掩码重建等机制,在PAD基准及FSAD任务上实现最优性能,兼具效率与泛化性。

Comments Accepted to ECCV 2026 (oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04042 2026-08-06 cs.RO 新提交 57%

Kitchen Robotic Manipulation utilizing Foundation Models

基于基础模型的厨房机器人操作

Myung-Hwan Jeon, Sankalp Yamsani, Joohyung Kim

机构 * Kumoh National Institute of Technology(金乌国立技术大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 本研究提出一种整合多种基础模型的模块化厨房机器人感知流水线,经评估优化后可在杂乱遮挡场景下实现89.12%的ADI,无需环境重训练即可完成餐具处理等家庭操作任务。

Comments Intelligent Service Robotics (ISR)

详情

展开后加载摘要…

URL PDF HTML 收藏