Language-Conditioned World Modeling for Visual Navigation
基于语言的视觉导航世界建模
机构 * University of Washington(华盛顿大学) ; National University of Singapore(新加坡国立大学) ; Clemson University(克莱姆森大学) ; Drexel University(德雷塞尔大学) ; Microsoft Research(微软研究院)
专题命中 具身导航 :navigation(title,abstract);world model(title,abstract);embodied agent(abstract);分类 cs.RO、cs.AI、cs.CV
AI总结 本文研究了基于语言的视觉导航问题,提出LCVN数据集并开发了两种模型家族,通过语言 grounding、未来状态预测和动作生成实现统一任务学习。
Comments 19 pages, 6 figures, Code: https://github.com/F1y1113/LCVN