Reliability-Aware Geometric Fusion for Robust Audio-Visual Navigation
可靠性感知的几何融合用于鲁棒的音频视觉导航
机构 * Joint Research Laboratory for Embodied Intelligence, Xinjiang University(新疆大学联合具身智能研究实验室) ; Joint International Research Laboratory of Silk Road Multilingual Cognitive Computing, Xinjiang University(新疆大学丝绸之路多语种认知计算联合国际研究实验室) ; School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院)
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.AI、eess.AS
AI总结 本文提出RAVN框架,通过音频衍生的可靠性线索条件跨模态融合,动态校准音频和视觉输入的整合,引入Acoustic Geometry Reasoner和Reliability-Aware Geometric Modulation,提升复杂环境下的导航性能。
Comments Main paper (6 pages). Accepted for publication by the International Joint Conference on Neural Networks (IJCNN 2026)