arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-04-14 至 2026-04-14 共收录 15 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 15 篇

2604.10246 2026-04-14 cs.CV 83%

A Comparison of Multi-View Stereo Methods for Photogrammetric 3D Reconstruction: From Traditional to Learning-Based Approaches

多视图立体方法在摄影测量3D重建中的比较:从传统方法到基于学习的方法

Yawen Li, George Vosselman, Francesco Nex

机构 * Faculty of Geo-Information Science and Earth Observation (ITC), University of Twente(特温特大学地理信息科学与地球观测学院(ITC))

专题命中 三维重建 :3D reconstruction(title,abstract);point cloud(abstract);分类 cs.CV

AI总结 本文比较了传统与基于学习的多视图立体方法在摄影测量3D重建中的性能,评估了COLMAP与MVSNet、Stereo4D等方法在精度、覆盖范围和运行时间上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10415 2026-04-14 cs.CV cs.RO 76%

Point2Pose: Occlusion-Recovering 6D Pose Tracking and 3D Reconstruction for Multiple Unknown Objects Via 2D Point Trackers

Point2Pose:基于2D点跟踪器的遮挡恢复多未知物体6D姿态跟踪与3D重建

Tzu-Yuan Lin, Ho Jae Lee, Kevin Doherty, Yonghyeon Lee, Sangbae Kim

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV、cs.RO

AI总结 Point2Pose利用2D点跟踪器实现多未知物体的6D姿态跟踪与3D重建,在完全遮挡后能快速恢复,无需CAD模型或类别先验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05499 2026-04-14 cs.RO 74%

TOSC: Task-Oriented Shape Completion for Open-World Dexterous Grasp Generation from Partial Point Clouds

TOSC:面向任务的形状补全用于从部分点云生成开放世界灵巧抓取

Weishang Wu, Yifei Shi, Zhiping Cai

专题命中 三维重建 :point cloud(title);分类 cs.RO

AI总结 本文提出面向任务的形状补全方法,通过生成任务导向的接触区域完成方案,提升开放世界中灵巧抓取的性能,改进抓取位移和 Chamfer 距离。

Comments Accepted to AAAI 2026

Journal ref Proceedings of the AAAI Conference on Artificial Intelligence, 40(13), 10781-10789 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09862 2026-04-14 cs.CV 74%

FF3R: Feedforward Feature 3D Reconstruction from Unconstrained views

FF3R:从无约束视角实现前馈特征三维重建

Chaoyi Zhou, Run Wang, Feng Luo, Mert D. Pesé, Zhiwen Fan, Yiqi Zhong, Siyu Huang

机构 * Microsoft(微软) Clemson University(克莱姆森大学) Texas A&M University(德克萨斯A&M大学)

专题命中 三维重建 :3D reconstruction(title);分类 cs.CV

AI总结 FF3R提出一种无需标注的前馈框架,统一处理几何与语义推理,解决全局语义不一致和局部结构不一致问题,实验显示其在视图合成、语义分割和深度估计中表现优异。

Comments CVPR 2026 Findings. Project Page: https://chaoyizh.github.io/ff3r_project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10982 2026-04-14 cs.RO 70%

Ψ-Map: Panoptic Surface Integrated Mapping Enables Real2Sim Transfer

Ψ-Map:全景表面集成映射实现真实到仿真转移

Xuan Yu, Yuxuan Xie, Changjian Jiang, Shichao Zhai, Rong Xiong, Yu Zhang, Yue Wang

机构 * Department of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院)

专题命中 三维重建 :Gaussian Splatting(abstract);3DGS(abstract);分类 cs.RO

AI总结 Ψ-Map通过整合几何强化、端到端学习和高效渲染,实现大规模场景中高精度全景重建,兼顾几何精度与实时推理,满足机器人仿真需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11680 2026-04-14 cs.RO 57%

Dual-Control Frequency-Aware Diffusion Model for Depth-Dependent Optical Microrobot Microscopy Image Generation

双控频率感知扩散模型用于深度依赖光学微机器人显微图像生成

Lan Wei, Zongcai Tan, Kangyi Lu, Jian-Qing Zheng, Dandan Zhang

机构 * Department of Bioengineering, Imperial-X AI Initiative, Imperial College London(帝国理工学院生物工程系、Imperial-X人工智能计划) CAMS-Oxford Institute, University of Oxford(牛津大学CAMS-Oxford研究所)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 本文提出Du-FreqNet,通过双控频率感知扩散模型生成物理一致的显微图像,提升微机器人自主操作的3D感知能力,改进SSIM并增强下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28287 2026-04-14 cs.CV 57%

TerraSky3D: Multi-View Reconstructions of European Landmarks in 4K

TerraSky3D:欧洲地标多视角4K三维重建

Mattia D'Urso, Yuxi Hu, Christian Sormann, Mattia Rossi, Friedrich Fraundorfer

机构 * Graz University of Technology(格拉茨技术大学) Sony(索尼)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 TerraSky3D提供高分辨率的欧洲地标多视角三维重建数据集,包含5万张图像,涵盖地面、空中和混合场景,旨在为3D重建算法提供挑战性训练和评估数据。

Comments Accepted at 3DMV (CVPR Workshop 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19172 2026-04-14 cs.CV 57%

MetroGS: Efficient and Stable Reconstruction of Geometrically Accurate High-Fidelity Large-Scale Scenes

MetroGS: 高精度大规模场景高效稳定重建

Kehua Chen, Tianlu Mao, Xinzhu Ma, Hao Jiang, Zehao Li, Zihan Liu, Shuqin Gao, Honglong Zhao, Feng Dai, Yucheng Zhang, Zhaoqi Wang

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Beihang University(北京航空航天大学)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文提出MetroGS框架,通过分布式2D高斯点扩散表示和结构密集增强方案,结合单目与多视图优化策略,实现复杂城市环境中的高效高精度场景重建。

Comments Accepted by CVPR26; Project page: https://m3phist0.github.io/MetroGS

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10273 2026-04-14 cs.CV cs.LG 57%

How to Spin an Object: First, Get the Shape Right

如何旋转一个物体:首先,确保形状正确

Rishabh Kabra, Drew A. Hudson, Sjoerd van Steenkiste, Joao Carreira, Niloy J. Mitra

机构 * Google DeepMind(谷歌DeepMind) University College London(伦敦大学学院)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出unPIC框架,通过多视图几何先验和外观解码器分析图像到3D流程,发现CROCS表示在几何预测和多视图一致性方面优于其他方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10789 2026-04-14 cs.CV 57%

ReplicateAnyScene: Zero-Shot Video-to-3D Composition via Textual-Visual-Spatial Alignment

ReplicateAnyScene:通过文本-视觉-空间对齐实现零样本视频到3D场景的合成

Mingyu Dong, Chong Xia, Mingyuan Jia, Weichen Lyu, Long Xu, Zheng Zhu, Yueqi Duan

机构 * Tsinghua University(清华大学) Zhejiang University(浙江大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出ReplicateAnyScene框架,通过五阶段流水线实现视频到结构化3D场景的零样本合成,引入C3DR基准评估重建质量,实验表明其在生成高质量3D场景方面优于现有方法。

Comments Project Page: https://xiac20.github.io/ReplicateAnyScene/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07413 2026-04-14 cs.CV cs.AI cs.LG 57%

FORGE: Fine-grained Multimodal Evaluation for Manufacturing Scenarios

FORGE:面向制造场景的细粒度多模态评估

Xiangru Jian, Hao Xu, Wei Pang, Xinjian Zhao, Chengyu Tao, Qixin Zhang, Xikun Zhang, Chao Zhang, Guanzhi Deng, Alex Xue, Juan Du, Tianshu Yu, Garth Tarr, Linqi Song, Qiuzhuang Sun, Dacheng Tao

机构 * University of Waterloo(滑铁卢大学) University of Sydney(悉尼大学) Singapore Management University(新加坡管理大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Hunan University(湖南大学) Nanyang Technological University(南洋理工大学) Royal Melbourne Institute of Technology(皇家墨尔本理工大学) City University of Hong Kong(香港城市大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) City University of Hong Kong Shenzhen Research Institute(香港城市大学深圳研究院)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出FORGE,构建高质量多模态数据集并评估18种先进MLLM在制造任务中的表现,揭示领域知识不足是主要瓶颈,展示结构化标注可提升模型精度。

Comments Project Page:https://ai4manufacturing.github.io/forge-web

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09211 2026-04-14 cs.CV 57%

Affostruction: 3D Affordance Grounding with Generative Reconstruction

构形:基于生成重建的3D构形定位

Chunghyun Park, Seunghyeon Lee, Minsu Cho

机构 * Pohang University of Science and Technology (POSTECH)(浦项科技大学) RLWRLD

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出Affostruction框架,通过生成式重建完整物体几何并基于全形体进行构形定位,优于现有方法,在构形定位和3D重建上取得显著成绩。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09886 2026-04-14 cs.CV cs.AI cs.LG cs.MM eess.IV 57%

Not Your Stereo-Typical Estimator: Combining Vision and Language for Volume Perception

非典型立体视觉估计器:结合视觉与语言进行体积感知

Gautham Vinod, Bruce Coburn, Siddeshwar Raghavan, Fengqing Zhu

机构 * Purdue University(普渡大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出融合立体视觉隐式3D线索与自然语言显式先验知识的方法,通过多模态表示提升体积估计精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09643 2026-04-14 cs.CV 57%

PA-SFM: Tracker-free differentiable acoustic radiation for freehand 3D photoacoustic imaging

PA-SFM:无需跟踪器的可微声辐射用于自由手3D光声成像

Shuang Li, Jian Gao, Chulhong Kim, Seongwook Choi, Qian Chen, Yibing Wang, Shuang Wu, Yu Zhang, Tingting Huang, Yucheng Zhou, Boxin Yao, Yao Yao, Changhui Li

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出PA-SFM,通过可微声辐射建模实现无需外部传感器的自由手3D光声成像,实现了高精度3D重建和低成本解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03951 2026-04-14 eess.SP q-bio.QM 50%

Structure from Noise: Confirmation Bias in Particle Picking in Structural Biology

从噪声中提取结构:结构生物学中粒子选取中的确认偏见

Amnon Balanov, Alon Zabatani, Tamir Bendory

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 本文研究了单颗粒冷冻电子显微镜和冷冻电子断层扫描中粒子选取的确认偏见,通过最大似然估计和3D重建验证了噪声对结构的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏