Semantic Audio-Visual Navigation in Continuous Environments
语义音频视觉导航在连续环境中
机构 * Wuhan University(武汉大学) ; Zhongguancun Academy(中关村学院) ; Shandong Jianzhu University(山东建筑大学) ; Nankai University(南开大学) ; Tsinghua University(清华大学) ; CASIA(中国科学院自动化研究所) ; UCAS(中国科学院大学)
专题命中 视觉空间推理 :reasoning(abstract)
AI总结 本文提出MAGNet模型,通过多模态Transformer实现语义目标推理,提升在连续空间中导航的鲁棒性与成功率。
Comments This paper has been accepted to CVPR 2026