arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-03-03 至 2026-03-03 共收录 17 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 17 篇

2603.00492 2026-03-03 cs.CV cs.AI cs.GR cs.LG 84%

ArtiFixer: Enhancing and Extending 3D Reconstruction with Auto-Regressive Diffusion Models

ArtiFixer:利用自回归扩散模型增强和扩展3D重建

Riccardo de Lutio, Tobias Fischer, Yen-Yu Chang, Yuxuan Zhang, Jay Zhangjie Wu, Xuanchi Ren, Tianchang Shen, Katarina Tothova, Zan Gojcic, Haithem Turki

机构 * NVIDIA NVIDIA Santa Clara USA(NVIDIA) NVIDIA Zurich Switzerland(NVIDIA) Cornell University(康奈尔大学) University of Toronto(多伦多大学) Vector Institute(向量研究所)

专题命中 三维重建 :3D reconstruction(title);Gaussian Splatting(abstract);novel view synthesis(abstract);分类 cs.CV、cs.GR

AI总结 ArtiFixer通过自回归扩散模型提升3D重建质量,解决现有方法在未观测区域的外推问题。

Comments Video results: https://artifixer2026.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20160 2026-03-03 cs.CV 83%

tttLRM: Test-Time Training for Long Context and Autoregressive 3D Reconstruction

tttLRM:面向长上下文和自回归3D重建的测试时间训练

Chen Wang, Hao Tan, Wang Yifan, Zhiqin Chen, Yuheng Liu, Kalyan Sunkavalli, Sai Bi, Lingjie Liu, Yiwei Hu

机构 * University of Pennsylvania(宾夕法尼亚大学) Adobe Research(Adobe 研究) UCI(加州大学欧文分校)

专题命中 三维重建 :3D reconstruction(title,abstract);novel view synthesis(abstract);分类 cs.CV

AI总结 tttLRM通过测试时间训练实现长上下文自回归3D重建,提升重建质量和收敛速度。

Comments Accepted by CVPR 2026. Project Page: https://cwchenwang.github.io/tttLRM

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09407 2026-03-03 cs.CV 79%

Single-Slice-to-3D Reconstruction in Medical Imaging and Natural Objects: A Comparative Benchmark with SAM 3D

医学影像和自然物体的单切片到三维重建:与SAM 3D的比较基准

Yan Luo, Advaith Ravishankar, Serena Liu, Yutong Yang, Mengyu Wang

机构 * Harvard AI and Robotics Lab(哈佛人工智能与机器人实验室) Harvard University(哈佛大学)

专题命中 三维重建 :3D reconstruction(title,abstract);分类 cs.CV

AI总结 本文通过比较基准揭示了单切片到三维重建的局限性,指出SAM3D在医学形状拓扑相似性上表现最佳,但需领域适应和解剖约束以克服复杂医学几何。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02049 2026-03-03 cs.CV 70%

WorldStereo: Bridging Camera-Guided Video Generation and Scene Reconstruction via 3D Geometric Memories

WorldStereo: 通过3D几何记忆桥接相机引导的视频生成与场景重建

Yisu Zhang, Chenjie Cao, Tengfei Wang, Xuhui Zuo, Junta Wu, Jianke Zhu, Chunchao Guo

机构 * Zhejiang University(浙江大学) Tencent Hunyuan(腾讯文心)

专题命中 三维重建 :3D reconstruction(abstract);point cloud(abstract);分类 cs.CV

AI总结 WorldStereo通过3D几何记忆模块实现相机引导视频生成与3D场景重建的高效融合,提升多视角一致性与重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00905 2026-03-03 cs.CV 70%

pySpatial: Generating 3D Visual Programs for Zero-Shot Spatial Reasoning

pySpatial: 为零样本空间推理生成3D视觉程序

Zhanpeng Luo, Ce Zhang, Silong Yong, Cunxi Dai, Qianwei Wang, Haoxi Ran, Guanya Shi, Katia Sycara, Yaqi Xie

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Pittsburgh(匹兹堡大学) University of Michigan(密歇根大学)

专题命中 三维重建 :3D reconstruction(abstract);spatial understanding(abstract);分类 cs.CV

AI总结 pySpatial通过生成3D视觉程序,使大语言模型在无需微调的情况下实现零样本空间推理,并在基准测试和实际导航中表现出色。

Comments Accepted at ICLR 2026, Project Page: Our project: https://pySpatial.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14696 2026-03-03 cs.CV cs.GR cs.RO 67%

CRISP: Contact-Guided Real2Sim from Monocular Video with Planar Scene Primitives

CRISP: 从单目视频中基于接触引导的现实到仿真转换

Zihan Wang, Jiashun Wang, Jeff Tan, Yiwen Zhao, Jessica Hodgins, Shubham Tulsiani, Deva Ramanan

专题命中 三维重建 :point cloud(abstract);分类 cs.CV、cs.GR、cs.RO

AI总结 CRISP通过拟合平面原始体和强化学习,从单目视频中生成可模拟的现实到仿真环境,显著降低运动跟踪失败率。

Comments Published at ICLR 2026. Project page: https://crisp-real2sim.github.io/CRISP-Real2Sim/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01947 2026-03-03 cs.CV cs.AI 57%

physfusion: A Transformer-based Dual-Stream Radar and Vision Fusion Framework for Open Water Surface Object Detection

physfusion: 一种基于Transformer的双流雷达与视觉融合框架用于开放水域表面目标检测

Yuting Wan, Liguo Sun, Jiuwu Hao, Zao Zhang, Pin LV

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 PhysFusion通过物理引导雷达编码器和Transformer融合模块,实现开放水域表面目标的高效检测,取得高精度检测结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14492 2026-03-03 cs.RO 57%

UNCLE-Grasp: Uncertainty-Aware Grasping of Leaf-Occluded Strawberries

UNCLE-Grasp: 有不确定性意识的叶片遮挡草莓抓取

Malak Mansour, Ali Abouzeid, Zezhou Sun, Qinbo Sun, Dezhen Song, Abdalla Swikir

机构 * Department of Robotics, Mohamed bin Zayed University of Artificial Intelligence(机器人系,Mohamed bin Zayed人工智能大学)

专题命中 三维重建 :point cloud(abstract);分类 cs.RO

AI总结 UNCLE-Grasp通过建模遮挡和形状补全的几何不确定性,提出了一种在部分遮挡下可靠抓取草莓的方法,通过多假设评估和保守置信界标准提升抓取可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01836 2026-03-03 cs.CV 57%

Affine Correspondences in Stereo Vision: Theory, Practice, and Limitations

立体视觉中的仿射对应关系:理论、实践与局限性

Levente Hajder

机构 * L. Hajder Faculty of Informatics, E\"otv\"os Lor\' University, P\'azm\'any P\'eter stny. 1/C, Budapest, H-1117, Hungary

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文研究了仿射变换在立体视觉中的应用,提出新的局部仿射变换估计方法,并通过实验验证了其在3D重建中的精度与有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01812 2026-03-03 cs.CV cs.NA math.NA 57%

Neural Operator-Grounded Continuous Tensor Function Representation and Its Applications

神经运算机基础的连续张量函数表示及其应用

Ruoyang Su, Xi-Le Zhao, Sheng Liu, Wei-Hao Wu, Yisi Luo, Michael K. Ng

机构 * School of Mathematical Sciences, University of Electronic Science and Technology of China(电子科技大学数学科学学院) School of Mathematics and Statistics, Xi’an Jiaotong University(西安交通大学数学与统计学院) Department of Mathematics, Hong Kong Baptist University(香港 Baptist 大学数学系)

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 本文提出神经运算机基础的连续张量函数表示NO-CTR,通过连续非线性模式-n运算符提升复杂数据表示能力,并在多种数据集上验证其优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01194 2026-03-03 cs.CV 57%

RnG: A Unified Transformer for Complete 3D Modeling from Partial Observations

RnG:一种统一的Transformer,用于从有限观测中完整建模3D结构

Mochu Xiang, Zhelun Shen, Xuesong Li, Jiahui Ren, Jing Zhang, Chen Zhao, Shanshan Liu, Haocheng Feng, Jingdong Wang, Yuchao Dai

机构 * Northwestern Polytechnical University(西北工业大学) Baidu Inc.(百度公司) Australian National University(澳大利亚国立大学) CSIRO(澳大利亚联邦科学与工业研究组织)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 RnG提出了一种统一的Transformer模型,通过隐式3D表示实现从有限观测中完整重建3D结构并生成新视角。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21820 2026-03-03 cs.CV 57%

Joint Shadow Generation and Relighting via Light-Geometry Interaction Maps

基于光-几何交互映射的阴影生成与光照恢复

Shan Wang, Peixia Li, Chenchen Xu, Ziang Cheng, Jiayu Yang, Hongdong Li, Pulak Purkait

机构 * Amazon(亚马逊公司) Australian National University(澳大利亚国立大学)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 本文提出光-几何交互映射,通过联合阴影生成与光照恢复的统一流程,实现高效且物理一致的阴影处理。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00990 2026-03-03 cs.CV 57%

MLRecon: Robust Markerless Freehand 3D Ultrasound Reconstruction via Coarse-to-Fine Pose Estimation

MLRecon: 通过粗到细的姿态估计实现鲁棒的无标记自由手3D超声重建

Yi Zhang, Puxun Tu, Kun Wang, Yulin Yan, Tao Ying, Xiaojun Chen

机构 * Institute of Biomedical Manufacturing and Life Quality Engineering, School of Mechanical Engineering, Shanghai Jiao Tong University, Shanghai, China(生物医学制造与生命质量工程学院,机械工程学院,上海交通大学,上海,中国) Department of Ultrasound in Medicine, Shanghai Sixth People's Hospital Affiliated to Shanghai Jiao Tong University School of Medicine, Shanghai, China(医学超声科,上海第六人民医院(隶属于上海交通大学医学院)) Institute of Medical Robotics, Shanghai Jiao Tong University, Shanghai, China(医学机器人研究院,上海交通大学,上海,中国)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 MLRecon通过粗到细姿态估计实现无标记自由手3D超声重建,有效解决漂移问题,实现高精度的6D探头跟踪与高质量3D成像。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00908 2026-03-03 cs.CV 57%

UD-SfPNet: An Underwater Descattering Shape-from-Polarization Network for 3D Normal Reconstruction

UD-SfPNet: 一种用于水下散射消除的偏振形状从偏振网络用于3D法线重建

Puyun Wang, Kaimin Yu, Huayang He, Feng Huang, Xianyu Wu, Yating Chen

机构 * School of Mechanical Engineering and Automation, Fuzhou University(福州大学机械与自动化学院) The Research Institute of Highway, Ministry of Transport(交通部高速公路研究 institute) The State Key Laboratory of Precision Measurement Technology and Instruments, Department of Precision Instruments, Tsinghua University(清华大学精密测量技术与仪器国家重点实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 UD-SfPNet通过结合偏振成像的散射消除与形状从偏振技术,实现了水下3D法线重建的高精度与高效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00526 2026-03-03 cs.CV 57%

Mesh-Pro: Asynchronous Advantage-guided Ranking Preference Optimization for Artist-style Quadrilateral Mesh Generation

Mesh-Pro: 异步优势引导的排名偏好优化用于艺术家风格的四边形网格生成

Zhen Zhou, Jian Liu, Biwen Lei, Jing Xu, Haohan Weng, Yiling Zhu, Zhuo Chen, Junfeng Fan, Yunkai Ma, Dazhao Du, Song Guo, Fengshui Jing, Chunchao Guo

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Tencent Hunyuan(腾讯文元) Hong Kong University of Science and Technology(香港科技大学)

专题命中 三维重建 :3D generation(abstract);分类 cs.CV

AI总结 Mesh-Pro通过异步优势引导的排名偏好优化提升3D网格生成的训练效率和生成质量,引入了新的标记化和奖励机制,实现了艺术家风格网格的先进性能。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01141 2026-03-03 math.OC math.PR 50%

A First Step Towards Mesh-Free Probabilistic Shape Optimization

迈向无网格概率形状优化的第一步

Stephan Schmidt, Maximilian Würschmidt

专题命中 三维重建 :point cloud(abstract)

AI总结 本文提出了一种基于概率方法的无网格形状优化算法,利用神经网络求解PDE并结合蒙特卡洛采样进行形状导数评估,应用于跟踪问题。

Comments 13 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03819 2026-03-03 cs.LG 50%

Transmit Weights, Not Features: Orthogonal-Basis Aided Wireless Point-Cloud Transmission

传输权重,而非特征:基于正交基的无线点云传输

Junlin Chang, Yubo Han, Hang Yue, John S Thompson, Rongke Liu

机构 * Beihang University(北京航空航天大学) Pengcheng Laboratory(鹏城实验室) Shenzhen Institute of Beihang University(北京航空航天大学深圳研究院) University of Edinburgh(爱丁堡大学) IDCOM(影像、数据与通讯研究所)

专题命中 三维重建 :point cloud(abstract)

AI总结 本文提出基于正交基的无线点云传输框架,通过预测接收端语义正交特征池的组合权重,实现紧凑表示和稳健重建,并在不同带宽下表现出色。

Comments 5 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏