AD-AVSR: Asymmetric Dual-stream Enhancement for Robust Audio-Visual Speech Recognition
机构 * Zhengzhou University(郑州大学) ; Zhejiang Lab(浙江实验室) ; Xi'an Jiaotong University(西安交通大学)
专题命中 音频语音多模态 :audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV、cs.MM、eess.AS
Comments Accepted by the ACM MM 2025 Workshop on SVC