VLM-Guided Visual Place Recognition for Planet-Scale Geo-Localization
VLM引导的视觉地点识别用于行星级地理定位
机构 * Univ. of Southampton, UK(英国南安普顿大学) ; KAIST, South Korea(韩国科学技术院) ; QUT, Australia(昆士兰科技大学) ; Univ. of Essex, UK(英国埃塞克斯大学)
专题命中 视觉定位与Grounding :VLM(title,title_cn);vision-language model(abstract);分类 cs.CV
AI总结 提出VLM与检索式VPR结合的混合框架,利用VLM生成先验约束搜索空间,再通过检索和重排序实现行星级地理定位,在街道和城市级别分别提升4.51%和13.52%。
Journal ref Proceedings of the Australasian Conference on Robotics and Automation (ACRA 2025)