SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
SpatialNav: 利用空间场景图进行零样本视觉-语言导航
机构 * Fudan University, Shanghai, China(复旦大学) ; University of Southern California, Los Angeles, USA(南加州大学) ; Australian Institute for Machine Learning, Adelaide University, Australia(澳大利亚机器学习研究所) ; Shanghai Innovation Institute, Shanghai, China(上海创新研究院)
AI总结 SpatialNav通过构建空间场景图,利用全局空间表示提升零样本视觉-语言导航的效率与性能。
Comments 11 pages, 4 figures, 6 tables