CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation
CityLoc:基于高斯表示的大规模场景文本描述的6自由度姿态分布定位
机构 * Computer Vision Lab, ETH Zurich(苏黎世联邦理工学院计算机视觉实验室) ; University of Pisa(比萨大学) ; University of Trento(特伦托大学)
专题命中 可控生成 :diffusion(abstract);分类 cs.CV
AI总结 研究大规模场景文本描述的6自由度姿态分布定位问题,核心方法是用基于扩散架构结合预训练文本编码器细化姿态,经3D高斯渲染提高精度,通过与标准方法对比验证其在多数据集上的优越性。