Before Fusion, Ask What to Keep: Contextual Calibration of Multimodal Signals
融合之前,先问保留什么:多模态信号的上下文校准
机构 * Adelaide University(阿德莱德大学) ; Shandong University(山东大学)
专题命中 多模态训练与对齐 :multimodal(title,abstract);audio-visual(abstract);分类 cs.MM、eess.AS
AI总结 提出一种紧凑的校准模块,在融合前对各模态特征进行实例级和维度级调制,抑制不可靠成分并增强上下文支持信号,提升多模态任务性能。
Comments 11 pages, 7 figures, 9 tables