Towards Visual Query Localization in the 3D World
面向3D世界的视觉查询定位
机构 * Wuhan University(武汉大学) ; AutoLab, SAI, Shanghai Jiao Tong University(AutoLab、SAI、上海交通大学) ; Anyverse Dynamics ; University of Chinese Academy of Sciences(中国科学院大学) ; Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)
专题命中 点云 :point cloud(abstract);分类 cs.CV
AI总结 本文首次提出3D多模态视觉查询定位基准3DVQL,包含2002个序列和17万帧数据,通过点云、RGB图像和深度图像多模态数据提升研究灵活性,并提出LaF算法提升性能。
Comments Accepted to CVPR 2026. 8 pages