arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 4393 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 4393 篇

2605.12587 2026-05-14 cs.CV 57%

TrackCraft3R: Repurposing Video Diffusion Transformers for Dense 3D Tracking

TrackCraft3R:将视频扩散变换器重新用于密集3D跟踪

Jisu Nam, Jahyeok Koo, Soowon Son, Jaewoo Jung, Honggyu An, Junhwa Hur, Seungryong Kim

机构 * KAIST AI(韩国科学技术院人工智能研究所) Google DeepMind(谷歌DeepMind)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出TrackCraft3R,通过重新利用预训练的视频扩散变换器,实现了基于单目视频的密集3D跟踪,采用双潜表示和时间RoPE对齐设计,提升了跟踪性能和效率。

Comments Project page and code are available at https://cvlab-kaist.github.io/TrackCraft3r/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10707 2026-05-12 cs.RO 57%

ObjView-Bench: Rethinking Difficulty and Deployment for Object-Centric View Planning

ObjView-Bench:重新思考面向对象的视图规划中的难度与部署

Sicong Pan, Hao Hu, Xuying Huang, Benno Wingender, Maren Bennewitz

机构 * University of Bonn(波恩大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 本文提出ObjView-Bench框架,通过分离视图规划评估中的三个关键因素,改进了面向对象的视图规划评估方法,并展示了部署导向的评估协议对方法性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10449 2026-05-12 cs.CV 57%

Automated high-frequency quantification of fish communities and biomass using computer vision

利用计算机视觉自动高频率量化鱼群和生物量

Kota Ishikawa, Takuma Masui, Keita Koeda, Rickdane Gomez, Lucas Yutaka Kimura, Michio Kondoh

机构 * Graduate School of Life Sciences, Tohoku University(东北大学生命科学研究生院) Advanced Institute for Marine Ecosystem Change (WPI-AIMEC), Tohoku University(东北大学海洋生态系统变化先进研究所) Graduate School of Science and Engineering, University of the Ryukyus(冲绳大学理学研究院) Faculty of Science, University of the Ryukyus(冲绳大学理学部)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出一种基于计算机视觉的自动化框架,用于从水下视频中高频率量化鱼群和生物量,通过深度学习、多目标跟踪和3D重建技术,实现对鱼类种群和生物量的估计。

Comments 21 pages, 3 figures, supplementary information under Ancillary files

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08744 2026-05-12 cs.GR cs.AI cs.LG 57%

MeshFIM: Local Low-Poly Mesh Editing via Fill-in-the-Middle Autoregressive Generation

MeshFIM: 通过填入中间自回归生成实现局部低多边形网格编辑

Dingdong Yang, Jian Liu, Biwen Lei, Haohan Weng, Zhuo Chen, Song Guo, Hao Richard Zhang, Ali Mahdavi Amiri, Chunchao Guo

机构 * Tencent Hunyuan(腾讯文生) Simon Fraser University(西蒙弗雷泽大学) Hong Kong University of Science and Technology(香港科技大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.GR

AI总结 MeshFIM通过填入中间自回归生成方法实现局部低多边形网格编辑,解决精确边界连接、拓扑顺序保持和区域溢出抑制等挑战,提升网格修复和细化效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08030 2026-05-11 cs.CV cs.LG 57%

PET-Adapter: Test-Time Domain Adaptation for Full and Limited-Angle PET Image Reconstruction

PET-Adapter:全角度和有限角度PET图像重建的测试时间域适应

Rüveyda Yilmaz, Yuli Wu, Johannes Stegmaier, Volkmar Schulz

机构 * Institute of Imaging and Computer Vision, RWTH Aachen University, Germany(成像与计算机视觉研究所,亚琛工业大学,德国) Machine Learning for Medical Data, Heinrich Heine University Düsseldorf, Germany(医学数据机器学习,杜伊斯堡-艾森大学,德国)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 PET-Adapter通过测试时间域适应框架,使预训练于phantom数据的生成式PET重建模型适应不同解剖结构、示踪剂和扫描仪配置的临床数据,无需配对真实数据,提升全角度和有限角度重建性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07987 2026-05-11 eess.IV cs.CV 57%

Uncertainty Quantification for Cardiac Shape Reconstruction with Deep Signed Distance Functions via MCMC methods

基于MCMC方法的深度符号距离函数在心脏形状重建中的不确定性量化

Jan Verhülsdonk, Thomas Grandits, Francisco Sahli Costabal, Thomas Beiert, Simone Pezzuto, Alexander Effland

机构 * Department of Mathematics and Scientific Computing, University of Graz, Austria(格拉茨大学数学与科学计算系,奥地利) PRIN-PNRR project no. P2022N5ZNP(PRIN-PNRR项目编号P2022N5ZNP) INdAM-GNCS

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出结合深度符号距离函数与MCMC采样方法的不确定性感知心脏形状重建框架,通过隐式建模心脏几何并进行贝叶斯推断,实现高精度重建与可靠不确定性估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07149 2026-05-11 cs.CV 57%

Real-IAD MVN: A Multi-View Normal Vector Dataset and Benchmark for High-Fidelity Industrial Anomaly Detection

Real-IAD MVN:一种多视角法向量数据集和基准,用于高保真工业异常检测

Wenbing Zhu, Jianing Liang, Linjie Cheng, Yurui Pan, Zhuhao Chen, Qingwang Yan, Yudong Cheng, Jianghui Zhang, Mingmin Chi, Bo Peng

机构 * Fudan University(复旦大学) Shanghai Ocean University(上海海洋大学) Donghua University(东华大学) Rongcheer Co., Ltd.(荣驰科技有限公司)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出Real-IAD-MVN数据集,通过多视角法向量捕捉微细几何缺陷,验证密集多视角伪3D数据在工业异常检测中的优越性能。

Comments Accepted to CVPR 2025. 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05664 2026-05-08 cs.CV 57%

Sparse-to-Complete: From Sparse Image Captures to Complete 3D Scenes

稀疏到完整:从稀疏图像捕获到完整3D场景

Yiyang Shen, Yin Yang, Kun Zhou, Tianjia Shao

机构 * State Key Lab of CAD\&CG, Zhejiang University(浙江大学CAD与CG国家重点实验室) University of Utah(犹他大学) Hangzhou Research Institute of Holographic and AI Technology(杭州全息与人工智能技术研究院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出S2C-3D框架,通过六到八张图像实现高保真完整场景重建,结合专用扩散模型、视图一致性条件采样和相机轨迹规划,提升3D重建质量与鲁棒性。

Journal ref SIGGRAPH 2026 Conf. Proc

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28980 2026-05-04 cs.CV 57%

Stepper: Stepwise Immersive Scene Generation with Multiview Panoramas

Stepper:基于多视角全景图的分步沉浸式场景生成

Felix Wimbauer, Fabian Manhardt, Michael Oechsle, Nikolai Kalischek, Christian Rupprecht, Daniel Cremers, Federico Tombari

机构 * Google(谷歌) University of Oxford(牛津大学) MCML Technical University of Munich(慕尼黑技术大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 Stepper通过分步扩展多视角全景图,解决传统方法在视觉保真度与可探索性之间的权衡问题,实现高质量沉浸式3D场景生成。

Comments Accepted at CVPR 2026 Findings; Find our project page under https://fwmb.github.io/stepper/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21960 2026-05-04 eess.IV cs.CV cs.LG 57%

Conditional Diffusion Posterior Alignment for Sparse-View CT Reconstruction

基于条件扩散后验对齐的稀疏视图CT重建

Luis Barba, Johannes Kirschner, Benjamin Bejar

机构 * Swiss Data Science Center (SDSC) in Paul Scherrer Institute (PSI)(瑞士数据科学中心(SDSC)在保罗·舍勒研究所(PSI)) Swiss Data Science Center (SDSC) and ETH Zurich(瑞士数据科学中心(SDSC)和苏黎世联邦理工学院) Swiss Data Science Center (SDSC) and Paul Scherrer Institute (PSI)(瑞士数据科学中心(SDSC)和保罗·舍勒研究所(PSI))

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出CDPA方法,结合条件扩散与显式数据一致性,解决稀疏视图CT重建中3D体积扩展问题,通过2D U-Net模型提升切片一致性,并在合成和真实CBCT数据上取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10267 2026-05-01 cs.CV 57%

Long-LRM++: Preserving Fine Details in Feed-Forward Wide-Coverage Reconstruction

Long-LRM++:在前馈宽覆盖重建中保留细节

Chen Ziwen, Hao Tan, Peng Wang, Zexiang Xu, Li Fuxin

机构 * Adobe Research(Adobe研究院) Tripo AI(Tripo人工智能) Hillbot(Hillbot公司) Oregon State University(俄勒冈州立大学)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 Long-LRM++通过半显式场景表示与轻量解码器,在保持LaCT渲染质量的同时实现实时14FPS的A100 GPU性能,且能扩展至64输入视角,并在ScanNetv2上优于直接从高斯生成深度预测。

Journal ref IEEE/CVF Conference on Computer Vision and Pattern Recognition Findings (CVPRF), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04135 2026-04-30 cs.CV 57%

NTIRE 2026 3D Restoration and Reconstruction in Real-world Adverse Conditions: RealX3D Challenge Results

NTIRE 2026 3D修复与重建在真实恶劣环境中的应用:RealX3D挑战赛结果

Shuhong Liu, Chenyu Bao, Ziteng Cui, Xuangeng Chu, Bin Ren, Lin Gu, Xiang Chen, Mingrui Li, Long Ma, Marcos V. Conde, Radu Timofte, Yun Liu, Ryo Umagami, Tomohiro Hashimoto, Zijian Hu, Yuan Gan, Tianhan Xu, Yusuke Kurose, Tatsuya Harada, Junwei Yuan, Gengjia Chang, Xining Ge, Mache You, Qida Cao, Zeliang Li, Xinyuan Hu, Hongde Gu, Changyue Shi, Jiajun Ding, Zhou Yu, Jun Yu, Seungsang Oh, Fei Wang, Donggun Kim, Zhiliang Wu, Seho Ahn, Xinye Zheng, Kun Li, Yanyan Wei, Weisi Lin, Dizhe Zhang, Yuchao Chen, Meixi Song, Hanqing Wang, Haoran Feng, Lu Qi, Jiaao Shan, Yang Gu, Jiacheng Liu, Shiyu Liu, Kui Jiang, Junjun Jiang, Runyu Zhu, Sixun Dong, Qingxia Ye, Zhiqiang Zhang, Zhihua Xu, Zhiwei Wang, Phan The Son, Zhimiao Shi, Zixuan Guo, Xueming Fu, Lixia Han, Changhe Liu, Zhenyu Zhao, Manabu Tsukada, Zheng Zhang, Zihan Zhai, Tingting Li, Ziyang Zheng, Yuhao Liu, Dingju Wang, Jeongbin You, Younghyuk Kim, Il-Youp Kwak, Mingzhe Lyu, Junbo Yang, Wenhan Yang, Hongsen Zhang, Jinqiang Cui, Hong Zhang, Haojie Guo, Hantang Li, Qiang Zhu, Bowen He, Xiandong Meng, Debin Zhao, Xiaopeng Fan, Wei Zhou, Linzhe Jiang, Linfeng Li, Louzhe Xu, Qi Xu, Hang Song, Chenkun Guo, Weizhi Nie, Yufei Li, Xingan Zhan, Zhanqi Shi, Dufeng Zhang, Boyuan Tian, Jingshuo Zeng, Gang He, Yubao Fu, Weijie Wang, Cunchuan Huang

机构 * XInsight Lab(XInsight实验室) Hunan Duo(湖南 Duo) Insta3D DLMath_Vision(DLMath Vision) Insta3DDD Wanderer Diouj. El K7MQ Windrise ZZZ LowLight Wizards SUSTech-PCL(四川大学-PCL) EE-GS DV-Lowlight(3DV-Lowlight) DSmokeR(3DSmokeR) HangFans MonoSmokeGS FJNU-STAR DLLR(3DLLR) HNU AAA Harmony3D RunAI AIC-GER CC

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文综述了NTIRE 2026 3D修复与重建挑战赛,评估了提交方法在极端低光和烟雾降级环境下的3D重建进展,揭示了顶级方法的共同设计原则和有效策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26232 2026-04-30 cs.CV cs.AI 57%

DepthPilot: From Controllability to Interpretability in Colonoscopy Video Generation

DepthPilot:从可控性到可解释性在结肠镜视频生成中

Junhu Fu, Ke Chen, Weidong Guo, Shuyu Liang, Jie Xu, Chen Ma, Kehao Wang, Shengli Lin, Zeju Li, Yuanyuan Wang, Yi Guo, Shuo Li

机构 * College of Biomedical Engineering, Fudan University, Shanghai 200433, China(复旦大学生物医学工程学院) Key Laboratory of Medical Imaging Computing and Computer Assisted Intervention of Shanghai, Shanghai 200032, China(上海医学影像计算与计算机辅助干预重点实验室) Endoscopy Research Institute, Zhongshan Hospital, Fudan University, Shanghai 200032, China(复旦大学中山医院内窥镜研究所) Shanghai Collaborative Innovation Center of Endoscopy, Shanghai 200032, China(上海内窥镜协同创新中心) Department of Biomedical Engineering, Case Western Reserve University, Cleveland, OH 44106, USA(凯斯西储大学生物医学工程系) Department of Computer and Data Science, Case Western Reserve University, Cleveland, OH 44106, USA(凯斯西储大学计算机与数据科学系)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出DepthPilot框架,通过几何对齐策略和自适应样条去噪模块,实现结肠镜视频生成的可控性与可解释性,取得高FID分数和临床评估领先成果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22658 2026-04-30 cs.CV 57%

PASR: Pose-Aware 3D Shape Retrieval from Occluded Single Views

PASR:基于遮挡单视图的姿态感知3D形状检索

Jiaxin Shi, Guofeng Zhang, Wufei Ma, Naifu Liang, Adam Kortylewski, Alan Yuille

机构 * Shanghai Jiao Tong University(上海交通大学) Johns Hopkins University(约翰霍普金斯大学) University of California, San Diego(加州大学圣地亚哥分校) CISPA Helmholtz Center for Information Security(CISPA海德堡信息安全中心)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 PASR通过将2D基础模型知识蒸馏到3D编码器,解决单视图3D形状检索中姿态感知与遮挡问题,实现更鲁棒的检索与多任务能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03269 2026-04-28 cs.CV cs.LG 57%

LoGeR: Long-Context Geometric Reconstruction with Hybrid Memory

LoGeR:长上下文几何重建与混合记忆

Junyi Zhang, Charles Herrmann, Junhwa Hur, Chen Sun, Ming-Hsuan Yang, Forrester Cole, Trevor Darrell, Deqing Sun

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 LoGeR通过混合记忆模块实现长序列的高精度3D重建,无需后优化,有效解决长视频中的上下文一致性问题,优于现有方法。

Comments Project page: https://LoGeR-project.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23574 2026-04-28 cs.CV 57%

PhysLayer: Language-Guided Layered Animation with Depth-Aware Physics

PhysLayer:基于语言的分层动画与深度感知物理

Tianyidan Xie, Zhentao Huang, Mingjie Wang, Xin Huang, Jun Zhou, Minglun Gong, Zili Yi

机构 * Nanjing University(南京大学) University of Guelph(圭尔夫大学) Zhejiang Sci-Tech University(浙江科技大学) Dalian Maritime University(大连海事大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 PhysLayer通过深度感知物理模拟和语言引导,实现静态图像的分层动画生成,提升了物理真实性和可控性,实验结果显示在多个指标上均有显著提升。

Comments Accepted to ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23537 2026-04-28 cs.GR 57%

Distance Field Rasterization for End-to-End Mesh Reconstruction

距离场光栅化用于端到端网格重建

Jinkai Cui, Kaiwen Song, Chumeng Niu, Juyong Zhang

专题命中 三维重建 :novel view synthesis(abstract);分类 cs.GR

AI总结 本文提出SDFRaster,结合光栅化效率与距离场,实现端到端网格重建,实验显示其在质量和存储成本上优于现有方法。

Comments Accepted to SIGGRAPH 2026, Project page: https://ustc3dv.github.io/SDFRaster/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22827 2026-04-28 cs.CV cs.LG 57%

DGHMesh: A Large-scale Dual-radar mmWave Dataset and Generalization-focused Benchmark for Human Mesh Reconstruction

DGHMesh: 一种大规模双雷达毫米波数据集及面向泛化能力的Human Mesh重建基准

Rongxiao Guo, Qingchao Chen

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出DGHMesh数据集和基准,用于评估毫米波Human Mesh重建方法的泛化能力,包含15名受试者8种动作的36万帧数据,采用多雷达融合框架mmPTM实现高精度重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22714 2026-04-27 cs.CV 57%

Long-tail Internet photo reconstruction

长尾互联网照片重建

Yuan Li, Yuanbo Xiangli, Hadar Averbuch-Elor, Noah Snavely, Ruojin Cai

机构 * Cornell University(康奈尔大学) Kempner Institute, Harvard University(哈佛大学凯普勒研究所)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文针对长尾分布的互联网照片重建问题,提出MegaDepth-X数据集和采样策略,提升极端稀疏场景下的3D重建鲁棒性,并增强对对称重复场景的重建可靠性。

Comments Project page: https://megadepth-x.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21749 2026-04-27 cs.GR 57%

CuRast: Cuda-Based Software Rasterization for Billions of Triangles

CuRast:基于CUDA的软件光栅化用于数十亿个三角形

Markus Schütz, Lukas Lipp, Elias Kristmann, Michael Wimmer

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.GR

AI总结 CuRast通过CUDA实现高效光栅化,可处理数十亿个三角形,比Vulkan快2-5倍(唯一)或12倍(实例化),但不支持透明和低多边形场景的高效处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00558 2026-04-23 cs.CV 57%

ViVo: A Dataset for Volumetric Video Reconstruction and Compression

ViVo:用于体积分解与压缩的数据集

Adrian Azzarelli, Ge Gao, Ho Man Kwan, Fan Zhang, Nantheera Anantrasirichai, Ollie Moolan-Feroze, David Bull

机构 * Visual Information Lab, University of Bristol(布里斯托大学视觉信息实验室) Condense Reality Ltd(Condense Reality有限公司)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出ViVo数据集,用于体积分解与压缩,包含多样化的内容,涵盖人类特征和动态视觉现象,通过基准测试展示了数据集的挑战性和现有方法的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19257 2026-04-22 cs.CV 57%

Unposed-to-3D: Learning Simulation-Ready Vehicles from Real-World Images

未置姿到3D:从真实世界图像学习仿真准备的车辆

Hongyuan Liu, Bochao Zou, Qiankun Liu, Haochen Yu, Qi Mei, Jianfei Jiang, Chen Liu, Cheng Bi, Zhao Wang, Xueyang Zhang, Yifei Zhan, Jiansheng Chen, Huimin Ma

机构 * University of Science and Technology Beijing(北京科技大学) Li Auto Inc(利汽车公司)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出Unposed-to-3D框架,通过图像-only监督从真实驾驶图像重建3D车辆,解决现有方法在真实世界分布上的领域差距问题,实现姿态一致且符合仿真的3D模型生成。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19025 2026-04-22 cs.RO 57%

RoomRecon: High-Quality Textured Room Layout Reconstruction on Mobile Devices

RoomRecon: 在移动设备上实现高质量纹理房间布局重建

Seok Joon Kim, Dinh Duc Cao, Federica Spinola, Se Jin Lee, Kyu Sung Cho

机构 * MAXST Co.(MAXST公司) MAXST Co., Ltd(MAXST有限公司) Independent Researcher(独立研究者)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 RoomRecon提出一种交互式实时扫描和纹理化流程,通过AR引导图像采集和生成式AI模型提升室内空间的纹理质量,实验表明其在纹理质量和设备计算时间上优于现有方法。

Comments 23 pages, including supplementary material. Accepted to the 2024 IEEE International Symposium on Mixed and Augmented Reality (ISMAR). Best Paper Nominee

Journal ref Proc. IEEE Int. Symp. Mixed and Augmented Reality (ISMAR), 2024, pp. 544-553

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17734 2026-04-21 cs.CV 57%

Score-Based Matching with Target Guidance for Cryo-EM Denoising

基于目标引导的cryo-EM去噪评分匹配

Xiaoqi Wu, Xueying Zhan, Wen Li, Junhao Wu, Xin Huang, Min Xu

机构 * Carnegie Mellon University(卡内基梅隆大学) Towson University(托马斯大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出基于评分的cryo-EM去噪框架,通过学习干净数据评分恢复粒子信号并保留结构信息,引入目标引导变体以稳定评分学习,提升下游分析性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17446 2026-04-21 cs.CV 57%

HyKey: Hyperspectral Keypoint Detection and Matching in Minimally Invasive Surgery

HyKey:微创手术中超光谱关键点检测与匹配

Alexander Saikia, Chiara Di Vece, Zhehua Mao, Sierra Bonilla, Chloe He, Joao Ramalhinho, Tobias Czempiel, Sophia Bano, Danail Stoyanov

机构 * University College London(伦敦大学学院) UCL Hawkes Institute(伦敦大学霍克斯研究所) EnAcuity Ltd.(EnAcuity公司)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出HyKey模型,通过融合3D和2D卷积神经网络提取超光谱图像的空谱特征,提升微创手术中关键点检测与匹配的鲁棒性。

Comments 15 pages, 5 figures, IPCAI/IJCARS

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17258 2026-04-21 cs.RO 57%

A Rapid Deployment Pipeline for Autonomous Humanoid Grasping Based on Foundation Models

基于基础模型的快速部署管道用于自主人形抓取

Yifei Yan, Yankai Liao, Linqi Ye

机构 * School of Future Technology, Shanghai University(未来技术学院,上海大学) School of Mechanical Engineering, Shanghai Institute of Technology(机械工程学院,上海理工大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 本文提出一种端到端的快速部署管道,利用基础模型组件将新物体的上boarding周期缩短至约30分钟,包括自动标注、3D重建和零样本6自由度姿态跟踪。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09530 2026-04-20 cs.CV 57%

DualTrack: Sensorless 3D Ultrasound needs Local and Global Context

DualTrack:无传感器3D超声需要局部和全局上下文

Paul F. R. Wilson, Matteo Ronchetti, Rüdiger Göbl, Viktoria Markova, Sebastian Rosenzweig, Raphael Prevost, Parvin Mousavi, Oliver Zettinig

机构 * Queen's University, Kingston, Canada(昆士兰大学) ImFusion GmbH, Munich, Germany(ImFusion GmbH)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 DualTrack提出了一种双编码器架构,通过解耦的局部和全局编码器分别提取特征,以提高无传感器3D超声的轨迹估计精度和3D重建一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12894 2026-04-15 cs.CV 57%

Representing 3D Faces with Learnable B-Spline Volumes

用可学习的B样条体积表示3D人脸

Prashanth Chandran, Daoye Wang, Timo Bolkart

机构 * Google(谷歌)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出CUBE方法,结合B样条体积与学习特征,用于3D扫描配准和单目3D人脸重建,通过高维控制特征提升模型表达能力,实现局部表面编辑。

Comments Accepted to CVPR 2026 (Highlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11680 2026-04-14 cs.RO 57%

Dual-Control Frequency-Aware Diffusion Model for Depth-Dependent Optical Microrobot Microscopy Image Generation

双控频率感知扩散模型用于深度依赖光学微机器人显微图像生成

Lan Wei, Zongcai Tan, Kangyi Lu, Jian-Qing Zheng, Dandan Zhang

机构 * Department of Bioengineering, Imperial-X AI Initiative, Imperial College London(帝国理工学院生物工程系、Imperial-X人工智能计划) CAMS-Oxford Institute, University of Oxford(牛津大学CAMS-Oxford研究所)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 本文提出Du-FreqNet,通过双控频率感知扩散模型生成物理一致的显微图像,提升微机器人自主操作的3D感知能力,改进SSIM并增强下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28287 2026-04-14 cs.CV 57%

TerraSky3D: Multi-View Reconstructions of European Landmarks in 4K

TerraSky3D:欧洲地标多视角4K三维重建

Mattia D'Urso, Yuxi Hu, Christian Sormann, Mattia Rossi, Friedrich Fraundorfer

机构 * Graz University of Technology(格拉茨技术大学) Sony(索尼)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 TerraSky3D提供高分辨率的欧洲地标多视角三维重建数据集,包含5万张图像,涵盖地面、空中和混合场景,旨在为3D重建算法提供挑战性训练和评估数据。

Comments Accepted at 3DMV (CVPR Workshop 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏