arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

共收录 749 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 149 篇

2608.08476 2026-08-11 cs.CV 新提交 57%

RayLift: Lifting Complementary Ray-Wise Evidence with 3D Geometry Priors for Semantic Scene Completion

RayLift:利用3D几何先验提升互补射线级证据以实现语义场景补全

Meng Wang, Hongxia Yu, Wenzhe He, Xingdong Song, Huilong Pi, Jiapeng Zhang, Ruihui Li

专题命中 三维重建 :3D vision(abstract);分类 cs.CV

AI总结 针对现有语义场景补全方法的深度误差传播问题,提出RayLift框架,通过互补上下文编码器、深度射线证据提升模块和语义感知体素集成器,在两个基准数据集上实现优于现有方法的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07559 2026-08-11 cs.CV cs.LG 新提交 57%

MVMD: A Multi-View Approach for Enhanced Mirror Detection

MVMD:用于增强镜面检测的多视图方法

Yidan Shen, Yu Wen, Chen Zhang, Xin Fu, Renjie Hu

机构 * University of Houston(休斯顿大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对现有镜面检测仅关注单图像的局限,提出多视图镜面检测方法MVMD及首个多视图镜面检测数据库,通过三个模块提升检测效果,使准确率和IoU分别最高提升2.6%和11.1%,增强了镜面密集环境下的三维重建准确性。

Comments This work has already published at WACV 2025, just want more accessibility

Journal ref 2025 IEEE/CVF Winter Conference on Applications of Computer Vision (WACV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06599 2026-08-10 cs.CV cs.ET 新提交 57%

Toward surface-based registration of a virtual preoperative cutting guide onto the mandible for reconstruction surgery

面向虚拟术前切割导板与下颌骨的基于表面的配准技术用于重建手术

Yue Yang, Jie Ying Wu

机构 * Vanderbilt University(范德堡大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 该研究提出一种无标记AR方案,通过扩展表面配准技术实现虚拟切割导板与术中暴露下颌骨的配准,经测试其配准误差与延迟支持替代物理打印导板的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06208 2026-08-07 cs.RO 新提交 57%

ErgoSurf: Ergodic Control for the Coverage of Unknown Surfaces

ErgoSurf:用于未知表面覆盖的遍历控制

Stefan Schneyer, Timo Bachmann, Maged Iskandar, Korbinian Nottensteiner, Alin Albu-Schäffer, Freek Stulp, João Silvério

机构 * German Aerospace Center (DLR)(德国航空航天中心) Technical University of Munich (TUM)(慕尼黑工业大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 提出ErgoSurf框架,结合GPIS模型与触觉传感,实现未知表面的遍历覆盖与几何在线学习,经仿真和真实机器人实验验证有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05066 2026-08-06 cs.CV 新提交 57%

Beyond Reprojection Error: Camera Calibration with 3D Targets

超越重投影误差:基于3D靶标的相机标定

Dennis Ruppel, Hasan Kutlu, Kai A. Neumann, Martin Knuth, Pedro Santos, Andreas Weinmann, Arjan Kuijper

机构 * Fraunhofer Institute for Computer Graphics Research(弗劳恩霍夫计算机图形研究所) Technical University of Applied Sciences Würzburg-Schweinfurt(维尔茨堡-施韦因富特应用技术大学) Technical University Darmstadt(达姆施塔特工业大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本研究针对三维重建提出基于场景射线预测的相机标定框架,采用重建与相交误差等指标,设计二十面体标定靶标,提升了标定精度,发现重投影误差可能误导三维精度评估。

Comments 16 pages, 7 figures, 2 tables. To appear in the proceedings of Computer Graphics International (CGI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04210 2026-08-06 cs.CV 新提交 57%

PADFormer: Pose-agnostic Anomaly Detection from Sparse View Images

PADFormer:基于稀疏视角图像的姿态无关异常检测

Ruiqi Wang, Yiming Qian, Fenggen Yu, Yuxuan Lu, Dakuo Wang, Hao Zhang, Jing Huang

机构 * Amazon(亚马逊) Simon Fraser University(西蒙菲莎大学) Northeastern University(东北大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对现有姿态无关异常检测方法依赖3D重建的缺陷,提出PADFormer模型,利用ViT结合跨视图掩码重建等机制,在PAD基准及FSAD任务上实现最优性能,兼具效率与泛化性。

Comments Accepted to ECCV 2026 (oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04042 2026-08-06 cs.RO 新提交 57%

Kitchen Robotic Manipulation utilizing Foundation Models

基于基础模型的厨房机器人操作

Myung-Hwan Jeon, Sankalp Yamsani, Joohyung Kim

机构 * Kumoh National Institute of Technology(金乌国立技术大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 本研究提出一种整合多种基础模型的模块化厨房机器人感知流水线,经评估优化后可在杂乱遮挡场景下实现89.12%的ADI,无需环境重训练即可完成餐具处理等家庭操作任务。

Comments Intelligent Service Robotics (ISR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03851 2026-08-05 cs.CV 新提交 57%

LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation

LiteMVS:结合基础模型蒸馏与专家聚合的高效多视图立体匹配

Tianbao Zhang, Zeyu Liu, Shuyu Wu, Fanxing Li, Zhaoxin Fan, Wenjun Wu, Danping Zou

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 LiteMVS是集成平面扫描几何推理与单目先验的轻量多视图深度模型,通过MoE和基础模型蒸馏提升重建质量与效率,在ScanNetv2等数据集上表现优异。

Comments CVPR 2026 Workshop accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03423 2026-08-05 cs.CV 新提交 57%

SGFormer: Structure-Guided Transformer for Robust Local Feature Matching

SGFormer:用于鲁棒局部特征匹配的结构引导Transformer

Runyu Zhu

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对局部特征匹配中Transformer注意力发散的问题,提出SGFormer结构引导Transformer,通过三重结构注意力模块增强显著结构区域的注意力,有效提升了匹配精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02598 2026-08-04 cs.CV 新提交 57%

VR3D: View-Robust 3D Representation Learning for Aerial-Ground Person Re-Identification

VR3D:面向空地行人重识别的视角鲁棒3D表示学习

Chao Ji, Shiyu Xuan, Zechao Li

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文针对空地行人重识别的视角偏差问题,提出VR3D框架,通过视角鲁棒3D表示交互与可靠性感知融合技术,在三个基准数据集上实现了优于现有方法的性能,CARGO数据集Rank-1提升5.63%。

Comments 12 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02016 2026-08-04 cs.CV 新提交 57%

Beyond Global Latents: Chunk-Based Sparse Grid VAE for Scalable 3D Modeling

超越全局隐变量:面向可扩展3D建模的基于块的稀疏网格变分自编码器

Kaiyi Zhang, Zhihao Liang, Haolin Liu, Qingxiang Lin, Zeqiang Lai, Yunfei Zhao, Bowen Zhang, Xianghui Yang, Zibo Zhao, Chunchao Guo, Long Quan

机构 * Hong Kong University of Science and Technology(香港科技大学) Tencent Hunyuan(腾讯混元) The Chinese University of Hong Kong(香港中文大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 该研究针对稀疏体素网格内存随分辨率快速增长的问题,提出基于块的ChunkVAE,通过局部算子和互补数据算子实现可扩展3D建模,在多基准测试中性能优于或相当基线,且内存与推理效率更优。

Comments 14 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01950 2026-08-04 cs.RO 新提交 57%

FRA-NBV: A Fast and Reflectivity-Aware Next-Best-View Strategy

FRA-NBV:一种快速且感知反射特性的最优下一个视点策略

G. F. Preziosa, E. Setti, M. Faroni, A. M. Zanchettin, P. Rocco

机构 * Politecnico di Milano(米兰理工大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 FRA-NBV策略针对反射表面导致的深度损失问题,通过识别反射区域并调整传感器位姿,提升工业场景下自主三维重建的覆盖率。

Comments 8 pages, 5 figures

Journal ref IEEE Robotics and Automation Letter, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00074 2026-08-04 cs.CV 新提交 57%

Explainable Multimodal AI for Adaptive Calibration of Archaeological Sensing Workflows

面向考古传感工作流自适应校准的可解释多模态人工智能

Nevio Dubbini, Daniel P. van Helden, Claudia Sciuto, Martina Naso, Arthur Leck, Clement Joubert, Heeli C. Schechter, Remy Chapoulie, Gabriele Gattiglia

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出一种可解释多模态AI框架,用于考古传感工作流的自适应校准、质量评估与采集支持,经多模态考古数据集验证可实现跨模态稳健质量评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29627 2026-08-03 cs.CV 新提交 57%

FlexComposer: Unified Video Compositing from Images to Dynamic Footage with Flexible Trajectory Control

FlexComposer:支持灵活轨迹控制的从图像到动态素材的统一视频合成框架

Songchun Zhang, Sitong Guo, Xianghao Kong, Pengwei Liu, Yuwei Guo, Lvmin Zhang, Anyi Rao

机构 * HKUST(香港科技大学) ZJU(浙江大学) CUHK(香港中文大学) Stanford University(斯坦福大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 FlexComposer是支持灵活轨迹控制的统一视频合成框架,通过三项关键设计实现静态图像与动态素材的无缝整合,在视觉质量等指标上优于现有SOTA方法。

Comments 30 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28995 2026-08-03 cs.RO 新提交 57%

Receding-Horizon Next-Best-View Planner for Autonomous Leaf Surface Reconstruction

面向自主叶片表面重建的滚动时域次最佳视点规划器

Arif Ahmed, Sajal K. Das, Parikshit Maini

机构 * University of Nevada, Reno(内华达大学雷诺分校) Missouri University of Science and Technology(密苏里科技大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 本研究针对自主叶片表面重建的规划预算与计算资源限制,提出滚动时域次最佳视点规划器,通过基于质心的信息增益函数优化视点效用,在草莓数据集上使重建精度较基线最高提升10%。

Comments Accepted at IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28442 2026-07-31 cs.CV 新提交 57%

ViewMind3D: Modular View-Aware Inference for Training-Free 3D-QA

ViewMind3D:用于无需训练的3D问答的模块化视图感知推理

Ping-Kun Chiang, Kun-Ru Wu, Po-han Li, Sandeep Chinchali, Ufuk Topcu, Yu-Chee Tseng

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 该研究提出无需训练的模块化框架ViewMind3D,将3D-QA分解为四个组件,在ScanQA和SQA3D上实现竞争力性能,证明通用LLMs与VLMs的模块化编排可实现有效3D推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28416 2026-07-31 cs.RO 新提交 57%

FasTac: A Curved Multispectral Vision-Based Tactile Sensor for High-Speed High-Precision 3D Shape and Force Perception

FasTac:一种用于高速高精度3D形状与力感知的曲面多光谱视觉触觉传感器

Xiaofan Lu, Kaiji Huang, Jiahui Chen, Yuankai Lin, Hua Yang, Zhouping Yin

机构 * State Key Laboratory of Intelligent Manufacturing Equipment and Technology, School of Mechanical Science and Engineering, Huazhong University of Science and Technology(华中科技大学机械科学与工程学院智能制造装备与技术国家重点实验室) National Innovation Institute of Digital Design and Manufacturing(国家数字化设计与制造创新中心)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.RO

AI总结 FasTac是一款集成多光谱光度立体、动态卷积力估计及FPGA加速的曲面多光谱视觉触觉传感器,可实现高精度3D形状与力感知,兼具高速处理能力,经实验验证其性能优于现有方案。

Comments 13 pages, 11 figures, including 2 pages of supplementary material. Submitted to IEEE/ASME Transactions on Mechatronics

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27139 2026-07-30 cs.CV 新提交 57%

SeasonStereo: Robust Dense Stereo Matching for Multi-Date Satellite Imagery via Generative AI

SeasonStereo:基于生成式AI的多日期卫星图像鲁棒密集立体匹配

Álvaro Díaz-Laureano, Roger Marí, Elías Masquil, Pablo Arias, Gabriele Facciolo

机构 * Eurecat(欧罗卡特技术中心) IIE, Facultad de Ingeniería, Universidad de la República(乌拉圭共和国大学工程学院IIE) Universitat Pompeu Fabra(庞培法布拉大学) Université Paris-Saclay(巴黎萨克雷大学) CNRS(法国国家科学研究中心) ENS Paris-Saclay(巴黎萨克雷高等师范学校) Institut Universitaire de France(法国大学研究院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 SeasonStereo框架利用带可控季节外观变化的合成图像对训练并结合基础模型零样本几何先验,实现低成本、高精度的多日期卫星图像密集立体匹配,支持大规模三维重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26646 2026-07-30 cs.CV 新提交 57%

Genie Sim PanoWorld: An Infinite Indoor 3D World Generation Pipeline via Panoramic Scene Modeling and Simulation

Genie Sim PanoWorld:基于全景场景建模与仿真的无限室内3D世界生成流水线

Yongxin Su, Linjie Hou, Feng Wang, Jialin Tang, Zhijun Li, Qian Wang, Maoqing Yao

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 Genie Sim PanoWorld是两阶段前馈流水线,从单张360°全景生成可自由导航的高保真3D高斯场景,优于几何条件基线,且能零样本泛化至未见室内场景

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24591 2026-07-28 cs.CV 新提交 57%

CameraAnything: Refilming Videos with Arbitrary Camera Control

CameraAnything:使用任意相机控制重新拍摄视频

Yixuan Li, Yanhong Zeng, Ka Leong Cheng, Jiayi Zhu, Hanlin Wang, Wen Wang, Yihao Meng, Hao Ouyang, Qiuyu Wang, Yue Yu, ZiDong Wang, Yiyuan Zhang, Yujun Shen, Dahua Lin

机构 * The Chinese University of Hong Kong(香港中文大学) Ant Group(蚂蚁集团) Tsinghua University(清华大学) Zhejiang University(浙江大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 CameraAnything是用于相机控制视频编辑的统一框架,采用逐像素普吕克光线注入等方法联合控制相机参数,开发合成管道克服数据稀缺,能在单过程中实现多种视频编辑操作,为视频制作提供实用价值。

Comments Project page: https://yixuanli98.github.io/cameraanything/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23758 2026-07-28 cs.CV 新提交 57%

RoadVGGT: Road-Structure-Aware Feed-Forward Road Surface Reconstruction

RoadVGGT:基于道路结构感知的前馈式路面重建

Han Jiao, Chen Liu, Jiakai Sun, Zhanjie Zhang, Mengyuan Yang, Yimeng Li, Mofan Zhou, Kun Zhan, Lei Zhao

专题命中 三维重建 :novel view synthesis(abstract);分类 cs.CV

AI总结 针对现有道路重建方法需逐场景训练及场景依赖覆盖设计的局限,提出RoadVGGT框架,利用几何基础模型结合多视图图像等,经高斯头预测、坐标对齐及融合等重建紧凑高斯路面,提升多方面性能,证明几何基础模型在路面重建中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22773 2026-07-28 eess.IV cs.CV physics.med-ph 新提交 57%

Metric Surface Reconstruction of Neurosurgical Scenes from Monocular Operating Microscope Images and Microscope Pose

从单目手术显微镜图像和显微镜位姿重建神经外科场景的度量曲面

Thomas Bucher, Didier Neuenschwander, Thomas Petutschnigg, Michael Murek, David Bervini, Andreas Raabe, Manuela Eugster

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 研究能否从单目手术显微镜图像和位姿数据重建神经外科场景的三维几何度量,利用预训练模型估计深度、泊松曲面重建点云成网格,结果显示该方法在模型设置中有技术可行性,支持相关手术技术进一步发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21438 2026-07-24 cs.CV 新提交 57%

DAPM: UAV Monocular Depth Estimation from Any Height, Pitch, Roll and FOV

DAPM:从任意高度、俯仰、横滚和视场角进行无人机单目深度估计

Tong Ling, Wenhui Diao, Yingchao Feng, Hanbo Bi, Zhongyan Hou, Xian Sun

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院空天信息创新研究院) School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院) University of Chinese Academy of Sciences(中国科学院大学) Key Laboratory of Target Cognition and Application Technology (TCAT), Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院空天信息创新研究院目标认知与应用技术重点实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 研究针对无人机单目深度估计在多样视角和大尺度深度分布下的难题,提出DAPM模型,通过建立视角定量表示,引入IGD和PQB模块,在UAPD数据集上实验,该模型在深度和相机姿态估计方面达最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19986 2026-07-23 cs.CV 新提交 57%

STEREOFLOW: Progressive Stereo Matching with StereoDiT and Transition Flow Matching

STEREOFLOW:基于StereoDiT和过渡流匹配的渐进式立体匹配

Hao Wang, Haoran Geng, Xiaotong Yang, Jing Tang, Songlin Wei, Linlong Lang, Yeying Jin, Zheng Zhu, Zhaoxin Fan, Biao Leng

机构 * School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) University of California, Berkeley(加州大学伯克利分校) University of Southern California(南加州大学) Google(谷歌公司) State Key Laboratory of Intelligent Manufacturing Equipment and Technology, Huazhong University of Science and Technology(华中科技大学智能制造装备与技术国家重点实验室) Tencent(腾讯公司) GigaAI(未知(可能是公司或组织,由于未找到确切对应中文名,按原文保留))

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 研究针对立体匹配问题,提出先验引导的生成框架StereoFlow,通过两阶段渐进级联匹配网络、像素扩散变压器StereoDiT和过渡流匹配实现高效优化,在多基准测试中取得多个最新结果,提升了立体匹配效果。

Comments 10 pages, 6 figures, submitted to TVCG

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19517 2026-07-23 cs.CV 新提交 57%

Crowd4D: Scene-Aware Monocular 4D Crowd Reconstruction

Crowd4D:场景感知单目4D人群重建

Hongbo Kang, Tianyi Zhou, Qingyang Yang, Hongwei Wen, Jing Huang, Yu-Kun Lai, Kun Li

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 针对单目视频恢复大规模场景下4D人群运动的难题,提出Crowd4D框架,通过多阶段优化联合优化人群与场景,引入HSIP解决对齐问题、CSCR提升时间稳定性,实验证明其性能优于现有方法,可实现复杂场景下单目4D人群稳健重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19228 2026-07-22 cs.CV 新提交 57%

IGGT4D: Streaming 4D Instance-Grounded Geometry Transformer

IGGT4D:流式4D实例关联几何变换器

Zhengyu Zou, Hao Li, Kuixuan Jiao, Liu Liu, Tingyang Xiao, Xiaolin Zhou, Fangzhou Hong, Zhizhong Su, Dingwen Zhang, Ziwei Liu

机构 * Horizon Robotics(地平线机器人公司) S-Lab, Nanyang Technological University(南洋理工大学S-Lab) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对现实世界空间智能中视频流场景理解问题,提出IGGT4D流式实例关联几何变换器,通过因果时空建模更新统一表示,还构建数据集。实验证明其在长动态序列在线推理上优于现有基线。

Comments Project Page: https://iggt4d.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17093 2026-07-21 cs.CV 新提交 57%

Autoregressive B-Rep Shape Generation with Parametric Surfaces

基于参数曲面的自回归 B-Rep 形状生成

Dafei Qin, Rui Xu, Zeyu Shen, Kaichun Qiao, Hongyang Lin, Qixuan Zhang, Huaijin Pi, Lan Xu, Jingyi Yu, Wenping Wang, Taku Komura

机构 * The University of Hong Kong(香港大学) Deemos Technology Co., Ltd.(迪莫斯科技有限公司) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) ShanghaiTech University(上海科技大学) Texas A&M University(德克萨斯A&M大学)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 研究提出 ParaCAD 自回归框架,用于点云条件 B-Rep 生成,直接在原生参数曲面上运行,通过以曲面为中心的令牌化编码面信息,先生成参数曲面再构建 B-Rep,实验证明其在多方面优于基于点的基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16288 2026-07-21 cs.CV 新提交 57%

A Synthetic 3D Gear Dataset for Manufacturing Quality Inspection (MFGNet-Gear)

用于制造质量检测的合成3D齿轮数据集(MFGNet-Gear)

Ruo-Syuan Mei, Chenhui Shao

机构 * University of Michigan(密歇根大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 研究针对智能制造中基于深度学习的零件质量检测数据难题,提出构建MFGNet-Gear合成3D数据集,通过参数化生成齿轮几何形状与缺陷,涵盖多种设计和质量等级,提供标注数据,助力相关检测、学习及基准测试,推动3D计量学发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14228 2026-07-17 cs.CV cs.AI 新提交 57%

SeeSE3: Emergence of 3D Space in Vision Features

SeeSE3:视觉特征中3D空间的出现

Caroline Chen, Sayna Ebrahimi, Fedor Kitashov, Ming-Hsuan Yang, Leonidas Guibas, Viorica Pătrăucean, Maks Ovsjanikov

机构 * Google DeepMind(谷歌DeepMind)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 研究视觉基础模型构建的表征与3D欧几里得空间内在属性的关系,提出从拓扑和几何角度评估的探测器,发现自监督视觉模型有相关潜在子空间,并基于此提出“潜在空间导航”技术用于视觉里程计和定位。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13265 2026-07-16 cs.CV 新提交 57%

Differentiable Polarized Path Tracing

可微偏振路径追踪

Pramod Rao, Jérémy Riviere, Xilong Zhou, Abhijeet Ghosh, Abhimitra Meka, Thabo Beeler, Marc Habermann, Christian Theobalt, Delio Vicini

机构 * Max Planck Institute for Informatics(马克斯·普朗克信息研究所) Saarland Informatics Campus(萨尔兰信息学园区) VIA Research Center(VIA研究中心) Google(谷歌)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 研究逆渲染问题,提出偏振感知的可微路径追踪方法,通过路径重放和局部缓存组合估计无偏梯度,能在复杂场景中高效稳定优化材质和光照参数,拓宽基于物理的逆渲染适用性。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏