arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

3D 视觉

三维重建、NeRF、Gaussian Splatting、点云和空间智能。

2026-06-26 至 2026-06-26 共收录 5 信号源:cs.CV, cs.GR, cs.RO

1. 三维重建 2 篇

2602.04349 2026-06-26 cs.CV cs.AI 版本更新 57%

VecSet-Edit: Unleashing Pre-trained LRM for Mesh Editing from Single Image

VecSet-Edit:利用预训练的LRM进行单图像网格编辑

Teng-Fang Hsiao, Bo-Kai Ruan, Yu-Lun Liu, Hong-Han Shuai

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学)

专题命中 三维重建 :Gaussian Splatting(abstract);分类 cs.CV

AI总结 本文提出VecSet-Edit,利用VecSet LRM进行单图像网格编辑,通过Mask引导的token播种和注意力对齐的token门控策略,结合漂移感知的token修剪和细节保留的纹理烘焙模块,实现高精度网格编辑。

Comments Accepted by SIGGRAPH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17916 2026-06-26 cs.CV 版本更新 57%

EndoUFM: Utilizing Foundation Models for Monocular depth estimation of endoscopic images

EndoUFM:利用基础模型进行内窥镜图像的单目深度估计

Xinning Yao, Bo Liu, Bojian Li, Jingjing Wang, Jinghua Yue, Fugen Zhou

机构 * Image Processing Center, Beihang University(北京航空航天大学图像处理中心) State Key Laboratory of High-Efficiency Reusable Aerospace Transportation Technology(高效可重复航天运输技术国家重点实验室)

专题命中 三维重建 :3D reconstruction(abstract);分类 cs.CV

AI总结 提出EndoUFM框架,通过双基础模型和自适应微调策略(RVLoRA和Res-DSC)提升内窥镜图像单目深度估计性能,在多个数据集上达到最优。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

2. Gaussian Splatting 1 篇

2603.10446 2026-06-26 cs.CV 版本更新 57%

SignSparK: Efficient Multilingual Sign Language Production via Sparse Keyframe Learning

SignSparK: 通过稀疏关键帧学习实现高效多语言手语生成

Jianhe Low, Alexandre Symeonidis-Herzig, Maksym Ivashechkin, Ozge Mercanoglu Sincan, Richard Bowden

机构 * CVSSP, University of Surrey, United Kingdom(CVSSP,萨里大学,英国)

专题命中 Gaussian Splatting :Gaussian Splatting(abstract);分类 cs.CV

AI总结 提出SignSparK框架,利用稀疏关键帧和条件流匹配生成流畅3D手语序列,缓解回归到均值问题,支持多语言和关键帧到姿态编辑,实现最先进性能。

Comments Accepted at European Conference on Computer Vision (ECCV) 2026. Project page available: https://cogvis-cvssp.github.io/papers/signspark/

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 点云 2 篇

2511.18254 2026-06-26 cs.CV 版本更新 57%

UniFlow: Zero-Shot LiDAR Scene Flow for Autonomous Vehicles

UniFlow: 自动驾驶车辆的零样本激光雷达场景流

Siyi Li, Qingwen Zhang, Ishan Khatri, Kyle Vedder, Eric Eaton, Deva Ramanan, Neehar Peri

专题命中 点云 :point cloud(abstract);分类 cs.CV

AI总结 提出UniFlow,一种跨多数据集训练的激光雷达场景流前馈模型,无需架构修改即可泛化到未见传感器,在Waymo和nuScenes上分别提升5.1%和35.2%,并在TruckScenes和AEVAScenes上超越先前数据集专用模型30.1%和22.5%。

Comments This work has been accepted to the European Conference on Computer Vision (ECCV) 2026. Project Page: https://lisiyi777.github.io/UniFlow/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08987 2026-06-26 cs.CR cs.MM cs.NI eess.IV 版本更新 50%

ABE-VVS: Attribute-Based Encrypted Volumetric Video Streaming

ABE-VVS:基于属性的加密体积视频流

Mohammad Waquas Usmani, Susmit Shannigrahi, Michael Zink

专题命中 点云 :point cloud(abstract)

AI总结 提出ABE-VVS框架,通过选择性加密点云坐标实现轻量级DRM,降低计算开销和延迟,实验表明仅加密X坐标可减少50%加密时间和80%解密时间,并实现零缓冲。

Comments Version 2: Extended to include experiments with RAM-based caching. The manuscript now contains 11 pages and 7 figures (including subfigures)

详情

展开后加载摘要…

URL PDF HTML 收藏