Audio Spatially-Guided Fusion for Audio-Visual Navigation
音频空间引导融合用于音频视觉导航
机构 * Joint Research Laboratory for Embodied Intelligence, Xinjiang University(新疆大学联合研究实验室,具身智能) ; Joint International Research Laboratory of Silk Road Multilingual Cognitive Computing, Xinjiang University(新疆大学丝绸之路多语言认知计算国际联合研究实验室) ; School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院)
专题命中 幻觉与事实性 :alignment(abstract);分类 cs.AI
AI总结 本文提出一种音频空间引导融合方法,通过自适应提取空间状态信息,实现多模态特征动态对齐与融合,提升在未知声源分布下的导航泛化能力。
Comments Main paper (6 pages). Accepted for publication by the International Joint Conference on Neural Networks (IJCNN 2026)