arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-07-28 至 2026-07-28 共收录 34 信号源:cs.CV, cs.GR, cs.RO

1. 点云 13 篇

2607.20393 2026-07-28 cs.DS cs.IR 版本更新 50%

Near-Optimal Dimension Lower Bounds for Single-Vector Embeddings of Maximum Inner Product Similarity

最大内积相似度单向量嵌入的近最优维度下界

Rajesh Jayaram, Honghao Lin, Vahab Mirrokni, David P. Woodruff

专题命中 点云 :point cloud(abstract)

AI总结 研究针对最大内积相似度单向量嵌入的维度下界问题。此前上下界在m指数上有差距,本文几乎弥合。证明结合方法得出,对固定δ及足够小ε、m≥(1/ε)^A_δ,单向量近似维度D≥m^(c_δ/ε^(2 - 2δ)),此结论对多种情况适用,指数接近上界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14981 2026-07-28 cs.LG 版本更新 50%

Distance-Matrix Wasserstein Statistics for Scalable Gromov--Wasserstein Learning

基于距离矩阵的Wasserstein统计用于可扩展的Gromov-Wasserstein学习

Ao Xu, Tieru Wu

专题命中 点云 :point cloud(abstract)

AI总结 本文提出距离矩阵Wasserstein统计,通过采样点并运输距离矩阵来近似Gromov-Wasserstein距离,证明其作为下界并建立反向逼近不等式,同时提供有限样本界和可扩展计算方法。

Comments The authors withdraw this manuscript because its attribution and positioning relative to prior work require substantial correction, and several technical arguments require further verification. The current version should not be relied upon

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 新视角合成 1 篇

2606.28828 2026-07-28 cs.CV 版本更新 57%

Ground4D: Consistency-Aware 4D Reconstruction from Monocular Video

Ground4D: 从单目视频进行一致性感知的四维重建

Qing Zhao, Weijian Deng, Pengxu Wei, Liang Lin

机构 * School of Computer Science and Engineering, Sun Yat-sen University, China(中山大学计算机科学与工程学院) Tsinghua Shenzhen International Graduate School, Tsinghua University, China(清华大学深圳国际研究生院)

专题命中 新视角合成 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出Ground4D框架,结合3D基础模型进行几何初始化与动态高斯泼溅进行一致性优化,实现从单目视频的高保真4D重建与新视角渲染。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 3D生成 1 篇

2607.24298 2026-07-28 cs.CV 新提交 79%

UMI3D: Robust 3D Generation on Unconstrained Multi-Image Inputs via Simultaneous Focus Cross-Attention Routing

UMI3D:通过同步聚焦交叉注意力路由在无约束多图像输入上进行稳健的3D生成

Zefan Qu, Zhenwei Wang, Gerhard Petrus Hancke, Rynson W. H. Lau

专题命中 3D生成 :3D generation(title,abstract);分类 cs.CV

AI总结 研究针对3D基础模型在无约束多图像输入上表现不佳的问题,提出UMI3D框架,通过同步聚焦交叉注意力路由,利用体素参考分数,无需训练即可提升单图像3D生成框架在多图像输入时的性能。

Comments Project Page: https://umi3d-project.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏