arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-15 至 2026-06-15 共收录 16 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 3 篇

2606.14389 2026-06-15 cs.CV 新提交 83%

MooMIns -- Monocular 3D Reconstruction and Object Pose Estimation from Multiple Instances

MooMIns -- 多实例单目3D重建与物体姿态估计

Robert Langendörfer, Markus Hillemann, Markus Ulrich

机构 * Institute of Photogrammetry and Remote Sensing, Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院摄影测量与遥感研究所)

专题命中 三维重建 :3D reconstruction(title,abstract);Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出MooMIns方法,利用单张图像中同一物体的多个实例提供隐式多视图几何,通过反向高斯泼溅实现3D重建和6D姿态估计,避免深度先验导致的幻觉。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14162 2026-06-15 cs.CV 新提交 57%

VideoWeave: Unlocking Geometric Consistency in Video Generation via Joint Geometry-Video Modeling

VideoWeave: 通过联合几何-视频建模解锁视频生成中的几何一致性

Xunzhi Xiang, Zixuan Duan, Yabo Chen, Zhengxuan Wei, Guiyu Zhang, Zixiao Gu, Zhe Gao, Haibin Huang, Chi Zhang, Qi Fan, Xuelong Li

机构 * Nanjing University(南京大学) Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院(TeleAI)) Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 三维重建 :point cloud(abstract);分类 cs.CV

AI总结 提出VideoWeave,一种在潜在空间后训练框架,利用隐式几何模型特征约束生成分布,缓解几何重建误差,提升视频几何一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14344 2026-06-15 cs.LG 新提交 50%

More with LESS -- Local Scene Representations for Tactile Imaging

用更少实现更多——局部场景表示用于触觉成像

Zohar Rimon, Elisei Shafer, Tal Tepper, Daniel Kozin, Alon Malka, Roy Holland, Aviv Tamar

机构 * Technion - Israel Institute of Technology(以色列理工学院) Rambam Health Care Campus(拉姆巴姆医疗中心)

专题命中 三维重建 :3D reconstruction(abstract)

AI总结 提出局部编码器空间感知(LESS)方法,通过局部感受野的循环编码器网格建模触觉场景,实现内部结构的2D/3D重建,在泛化、不确定性估计和手持成像上取得突破。

Comments RSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. NeRF 1 篇

2502.00869 2026-06-15 cs.CV 版本更新 81%

A Unified Theory of Sinusoidal Activation Families for Implicit Neural Representations

隐式神经表示的正弦激活函数族统一理论

Alireza Morsali, MohammadJavad Vaez, Mohammadhossein Soltani, Amirhossein Kazerouni, Babak Taati, Morteza Mohammad-Noori

机构 * McGill University(麦吉尔大学) University of Melbourne(墨尔本大学) ARC Centre of Excellence for the Mathematical Analysis of Cellular Systems (MACSYS)(细胞系统数学分析卓越中心(MACSYS)) University of Toronto(多伦多大学) Vector Institute(向量研究所) University Health Network(大学健康网络) University of Tehran(塔里斯坦大学)

专题命中 NeRF :NeRF(summary_cn,abstract);分类 cs.CV

AI总结 提出STAF框架,通过可学习振幅、频率和相位的傅里叶式激活函数,理论分析其表达能力、NTK谱变化及初始化,实验证明在图像、音频、形状、逆问题和NeRF任务中优于或匹敌现有方法。

Comments Published in TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏

3. Gaussian Splatting 3 篇

2210.00379 2026-06-15 cs.CV 95%

NeRF: Neural Radiance Field in 3D Vision: A Comprehensive Review (Updated Post-Gaussian Splatting)

NeRF: 3D视觉中的神经辐射场:全面综述(更新后Gaussian Splatting发布后)

Kyle Gao, Yina Gao, Hongjie He, Dening Lu, Linlin Xu, Jonathan Li

机构 * Faculty of Engineering, University of Toronto(多伦多大学工程学院) Department of Geomatics Engineering, University of Calgary(卡尔加里大学测绘工程系)

专题命中 Gaussian Splatting :Gaussian Splatting(title,title_cn);NeRF(title,title_cn);3D vision(title);novel view synthesis(abstract)

AI总结 本文综述了NeRF在过去五年的研究,涵盖了在Gaussian Splatting出现前和后的发展,总结了NeRF在新颖视角合成和3D隐式和混合表示神经场学习中的应用和贡献。

Comments Updated Post-Gaussian Splatting

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13990 2026-06-15 cs.RO 新提交 57%

SplatlessDF: Continuous Distance Field Mapping with Non-Splatting Gaussians

SplatlessDF: 基于非溅射高斯分布的连续距离场映射

Monisha Mushtary Uttsha, Lan Wu, Teresa Vidal-Calleja

机构 * UTS Robotics Institute, Faculty of Engineering and IT, University of Technology Sydney(悉尼科技大学工程与信息技术学院UTS机器人研究所) School of Engineering, University of Western Australia(西澳大学工程学院)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.RO

AI总结 提出SplatlessDF框架,利用各向异性高斯元素从空间角度构建连续距离场,支持距离和梯度查询,并可与2D高斯溅射结合实现统一建模,适用于机器人导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05102 2026-06-15 cs.CV 版本更新 57%

ZipSplat: Fewer Gaussians, Better Splats

ZipSplat: 更少的高斯,更好的泼溅

Alexander Veicht, Sunghwan Hong, Dániel Baráth, Marc Pollefeys

机构 * ETH Zürich(苏黎世联邦理工学院) Microsoft(微软)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出 ZipSplat,一种基于令牌的前馈模型,通过聚类压缩视觉令牌并解码为高斯组,在无需重训练的情况下实现质量-效率权衡,以约6倍更少的高斯数在DL3DV和RealEstate10K上达到新最优。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 点云 5 篇

2606.14355 2026-06-15 cs.CV eess.SP 新提交 79%

Point Cloud Upsampling through Patch-based Frequency Superposition

基于补丁频率叠加的点云上采样

Marina Ritthaler, Azhar Hussian, Vasileios Belagiannis, André Kaup

机构 * Friedrich-Alexander-Universität Erlangen-Nürnberg(埃尔朗根-纽伦堡大学)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 提出一种基于补丁频率叠加的优化方法PUtPFS,通过选择点子集并叠加空间频率估计表面,在稀疏区域放置新点实现均匀上采样,无需训练数据,在点对面距离上超越现有方法。

Journal ref European Conference on Signal Processing (EUSIPCO) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14292 2026-06-15 cs.CV 新提交 79%

A Robust Point Cloud Analysis Framework Inspired By Primary Visual Cortex

一种受初级视觉皮层启发的鲁棒点云分析框架

Jisheng Dang, Dengyue Pan, Delin Deng, Yifan Zhang, Bimei Wang, Hong Peng, Bin Hu, Qi Tian, Tat-Seng Chua

机构 * School of Information Science and Engineering, Lanzhou University(兰州大学信息科学与工程学院) School of Medical Technology, Beijing Institute of Technology(北京理工大学医学技术学院) Cloud and AI BU, Huawei(华为云与AI业务部) School of Computing, National University of Singapore(新加坡国立大学计算机学院)

专题命中 点云 :point cloud(title,abstract);分类 cs.CV

AI总结 受初级视觉皮层启发,提出DC-CCNN++框架,通过仿生神经网络替代MLP,结合NRMR模块和CPVT策略,在点云分类和分割中提升鲁棒性,性能媲美SOTA。

Comments 12 pages, 2 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12728 2026-06-15 cs.RO cs.CV cs.LG 新提交 62%

EquiDexFlow: Contact-Grounded SE(3)-Equivariant Dexterous Grasp Generative Flows

EquiDexFlow: 基于接触的SE(3)-等变灵巧抓取生成流

Clinton Enwerem, John S. Baras, Calin Belta

机构 * Institute for Systems Research, University of Maryland, College Park(马里兰大学帕克分校系统研究所)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 提出EquiDexFlow,一种SE(3)-等变流匹配模型,联合预测腕部姿态、关节角度、指尖接触、表面法线和接触力,通过将接触投影到物体表面并将力约束在库仑摩擦锥内,确保物理稳定抓取,在16自由度Allegro手上实现零摩擦违规和最佳综合分数。

Comments 22 pages, 11 figures, 11 tables. Project page with videos, code, and checkpoints: https://equidexflow.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05230 2026-06-15 cs.CV cs.RO 版本更新 62%

Digital Twin Driven Textile Classification and Foreign Object Recognition in Automated Sorting Systems

数字孪生驱动的自动化分拣系统中的纺织品分类与异物识别

Serkan Ergun, Tobias Mitterer, Hubert Zangl

机构 * Institute of Smart Systems Technologies(智能系统技术研究所) University of Klagenfurt(克雷格弗特大学) AAU SAL USE Laboratory(AAU SAL USE实验室) Silicon Austria Labs(硅 Austria 实验室)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 提出一种数字孪生驱动的机器人分拣系统,结合抓取预测、多模态感知和视觉语言模型,实现纺织品分类与异物检测,Qwen模型准确率达87.9%。

Comments 10 pages,single column, 5 figures, preprint for Photomet Edumet 2026 (Klagenfurt, Austria)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14562 2026-06-15 cs.CV cs.LG 新提交 57%

NEST3D: A High-Resolution Multimodal Dataset of Sociable Weaver Tree Nests

NEST3D:织布鸟树巢的高分辨率多模态数据集

Constanza A. Molina Catricheo, Simon Boeder, Ting-Jia Guo, Giacomo May, Clément Berthelot, Devis Tuia, Friedrich Fedor Reinhard, Fabio Remondino, Benjamin Risse

机构 * Institute for Geoinformatics (ifgi), University of Münster(明斯特大学地理信息学研究所) École Polytechnique Fédérale de Lausanne (EPFL)(洛桑联邦理工学院) Max Planck Institute of Animal Behavior(马克斯·普朗克动物行为研究所) University of Konstanz(康斯坦茨大学) Kuzikus Research Station(库兹库斯研究站) Fondazione Bruno Kessler (FBK)(布鲁诺·凯斯勒基金会)

专题命中 点云 :3D reconstruction(abstract);分类 cs.CV

AI总结 针对织布鸟巢缺乏精细3D结构数据的问题,提出包含104棵巢树、1.4TB多模态无人机数据集,并基准测试语义分割方法,PT-v3达86.35% mIoU。

Comments 14 pages, 4 figures. Dataset available at https://huggingface.co/NEST3D

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 新视角合成 1 篇

2512.14366 2026-06-15 cs.CV 版本更新 57%

Optimizing Rank for High-Fidelity Implicit Neural Representations

优化秩以实现高保真隐式神经表示

Julian McGinnis, Florian A. Hölzl, Suprosanna Shit, Florentin Bieder, Paul Friedrich, Mark Mühlau, Bjoern Menze, Daniel Rueckert, Benedikt Wiestler

机构 * University of Cambridge(剑桥大学)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 本文通过训练中稳定秩的调控,证明简单MLP也能实现高保真隐式神经表示,使用Muon优化器可显著提升性能,在多种任务上PSNR提升高达9 dB。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 空间理解 1 篇

2606.05774 2026-06-15 cs.CV 版本更新 70%

LiAuto-GeoX: Efficient Grounded Driving Transformer

LiAuto-GeoX: 高效接地驾驶Transformer

Jiawei Lian, Haoyi Sun, Yang Wu, Lifu Mu, Siyuan Wang, Le Hui, Ning Mao, Tao Wei, Pan Zhou, Kun Zhan, Jian Yang

机构 * Nanjing University of Science and Technology(南京理工大学) Li Auto Inc.(Li Auto公司) Northwestern Polytechnical University(西北工业大学) Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算学院)

专题命中 空间理解 :3D reconstruction(abstract);spatial understanding(abstract);分类 cs.CV

AI总结 提出LiAuto-GeoX,通过稀疏激光雷达先验和几何保持蒸馏框架,实现高效、实时的自车中心密集3D重建,并显著提升下游自动驾驶任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

7. SLAM与定位 1 篇

2606.14534 2026-06-15 cs.CV 新提交 57%

A Lightweight Fiducial-Based Pipeline for 3D Hyperspectral Mapping of ex-vivo Lumpectomy Specimens

一种轻量级基于基准的离体肿块切除标本三维高光谱映射流水线

Anna Bicchi, Alberto Rota, Leonardo Passoni, Nicola Ancellotti, Andrea Peroni, Lorenzo Vinco, Dario Polli, Elena De Momi

机构 * Politecnico di Milano(米兰理工大学) Department of Electronics, Information and Bioengineering (DEIB), Politecnico di Milano(米兰理工大学电子、信息与生物工程系) Department of Physics, Politecnico di Milano(米兰理工大学物理系)

专题命中 SLAM与定位 :point cloud(abstract);分类 cs.CV

AI总结 提出一种全自动、免标定流水线,利用RGB图像和单次HSI采集生成离体肿块切除标本的三维高光谱点云,通过ArUco标记实现亚毫米级配准,支持术中切缘评估。

详情

展开后加载摘要…

URL PDF HTML 收藏

8. 其他3D视觉 1 篇

2604.14193 2026-06-15 cs.CV eess.IV q-bio.NC 版本更新 57%

QualiaNet: An Experience-Before-Inference Network

QualiaNet:一种先验体验的推理网络

Paul Linton

机构 * Columbia University(哥伦比亚大学)

专题命中 其他3D视觉 :3D vision(abstract);分类 cs.CV

AI总结 提出QualiaNet,模拟人类立体视觉的两阶段架构:先通过视差图模拟体验,再用CNN从视差梯度估计距离,验证了从视差梯度恢复距离的可行性。

Journal ref Extended abstract presented at the 9th Conference on Cognitive Computational Neuroscience, New York, NY, USA, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏