arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-15 至 2026-06-15 共收录 6 信号源:cs.CV, cs.GR, cs.RO

1. NeRF 1 篇

2502.00869 2026-06-15 cs.CV 版本更新 81%

A Unified Theory of Sinusoidal Activation Families for Implicit Neural Representations

隐式神经表示的正弦激活函数族统一理论

Alireza Morsali, MohammadJavad Vaez, Mohammadhossein Soltani, Amirhossein Kazerouni, Babak Taati, Morteza Mohammad-Noori

机构 * McGill University(麦吉尔大学) University of Melbourne(墨尔本大学) ARC Centre of Excellence for the Mathematical Analysis of Cellular Systems (MACSYS)(细胞系统数学分析卓越中心(MACSYS)) University of Toronto(多伦多大学) Vector Institute(向量研究所) University Health Network(大学健康网络) University of Tehran(塔里斯坦大学)

专题命中 NeRF :NeRF(summary_cn,abstract);分类 cs.CV

AI总结 提出STAF框架,通过可学习振幅、频率和相位的傅里叶式激活函数,理论分析其表达能力、NTK谱变化及初始化,实验证明在图像、音频、形状、逆问题和NeRF任务中优于或匹敌现有方法。

Comments Published in TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 1 篇

2606.05102 2026-06-15 cs.CV 版本更新 57%

ZipSplat: Fewer Gaussians, Better Splats

ZipSplat: 更少的高斯,更好的泼溅

Alexander Veicht, Sunghwan Hong, Dániel Baráth, Marc Pollefeys

机构 * ETH Zürich(苏黎世联邦理工学院) Microsoft(微软)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出 ZipSplat,一种基于令牌的前馈模型,通过聚类压缩视觉令牌并解码为高斯组,在无需重训练的情况下实现质量-效率权衡,以约6倍更少的高斯数在DL3DV和RealEstate10K上达到新最优。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 1 篇

2603.05230 2026-06-15 cs.CV cs.RO 版本更新 62%

Digital Twin Driven Textile Classification and Foreign Object Recognition in Automated Sorting Systems

数字孪生驱动的自动化分拣系统中的纺织品分类与异物识别

Serkan Ergun, Tobias Mitterer, Hubert Zangl

机构 * Institute of Smart Systems Technologies(智能系统技术研究所) University of Klagenfurt(克雷格弗特大学) AAU SAL USE Laboratory(AAU SAL USE实验室) Silicon Austria Labs(硅 Austria 实验室)

专题命中 点云 :point cloud(abstract);分类 cs.CV、cs.RO

AI总结 提出一种数字孪生驱动的机器人分拣系统,结合抓取预测、多模态感知和视觉语言模型,实现纺织品分类与异物检测,Qwen模型准确率达87.9%。

Comments 10 pages,single column, 5 figures, preprint for Photomet Edumet 2026 (Klagenfurt, Austria)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 新视角合成 1 篇

2512.14366 2026-06-15 cs.CV 版本更新 57%

Optimizing Rank for High-Fidelity Implicit Neural Representations

优化秩以实现高保真隐式神经表示

Julian McGinnis, Florian A. Hölzl, Suprosanna Shit, Florentin Bieder, Paul Friedrich, Mark Mühlau, Bjoern Menze, Daniel Rueckert, Benedikt Wiestler

机构 * University of Cambridge(剑桥大学)

专题命中 新视角合成 :novel view synthesis(abstract);分类 cs.CV

AI总结 本文通过训练中稳定秩的调控,证明简单MLP也能实现高保真隐式神经表示,使用Muon优化器可显著提升性能,在多种任务上PSNR提升高达9 dB。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 空间理解 1 篇

2606.05774 2026-06-15 cs.CV 版本更新 70%

LiAuto-GeoX: Efficient Grounded Driving Transformer

LiAuto-GeoX: 高效接地驾驶Transformer

Jiawei Lian, Haoyi Sun, Yang Wu, Lifu Mu, Siyuan Wang, Le Hui, Ning Mao, Tao Wei, Pan Zhou, Kun Zhan, Jian Yang

机构 * Nanjing University of Science and Technology(南京理工大学) Li Auto Inc.(Li Auto公司) Northwestern Polytechnical University(西北工业大学) Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算学院)

专题命中 空间理解 :3D reconstruction(abstract);spatial understanding(abstract);分类 cs.CV

AI总结 提出LiAuto-GeoX,通过稀疏激光雷达先验和几何保持蒸馏框架,实现高效、实时的自车中心密集3D重建,并显著提升下游自动驾驶任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 其他3D视觉 1 篇

2604.14193 2026-06-15 cs.CV eess.IV q-bio.NC 版本更新 57%

QualiaNet: An Experience-Before-Inference Network

QualiaNet:一种先验体验的推理网络

Paul Linton

机构 * Columbia University(哥伦比亚大学)

专题命中 其他3D视觉 :3D vision(abstract);分类 cs.CV

AI总结 提出QualiaNet,模拟人类立体视觉的两阶段架构:先通过视差图模拟体验,再用CNN从视差梯度估计距离,验证了从视差梯度恢复距离的可行性。

Journal ref Extended abstract presented at the 9th Conference on Cognitive Computational Neuroscience, New York, NY, USA, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏