SEDualVLN: A Spatially-Enhanced Dual-System for Vision-Language Navigation
SEDualVLN:一种空间增强的双系统用于视觉语言导航
机构 * Hong Kong Polytechnic University(香港理工大学) ; Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
专题命中 图文多模态 :MLLM(abstract,abstract_cn);multimodal(abstract)
AI总结 本文提出SEDualVLN,一种空间增强的双系统框架,用于解决视觉语言导航中的长距离导航和动态推理问题,通过两个系统协同工作实现高效导航。