Multimodal Confidence Modeling in Audio-Visual Quality Assessment
音频视频质量评估中的多模态置信度建模
机构 * Texas State University Department of Computer Science(德克萨斯州立大学计算机科学系)
专题命中 音频语音多模态 :multimodal(title,abstract);audio-visual(title,abstract);cross-modal(abstract);分类 cs.CV、cs.MM
AI总结 本文提出MCM-AVQA框架,通过多模态置信度感知方法提升音频视频质量评估的准确性与可解释性,特别在处理不对称退化时表现更优。
Comments Accepted at ICIP 2026, 6 pages, 4 figures, no supplementary material