Benchmarking Cross-Domain Audio-Visual Deception Detection
跨域音视频欺骗检测基准测试
机构 * Rapid-Rich Object Search (ROSE) Lab and the College of Computing and Data Science, Nanyang Technological University (NTU)(快速丰富对象搜索(ROSE)实验室和南洋理工大学计算与数据科学学院) ; School of Computing and Information Technology and Dongguan Key Laboratory for Intelligence and Information Technology, Great Bay University(计算与信息科技学院和东莞智能与信息技术重点实验室,大湾大学) ; DSO National Laboratories(国防科学实验室) ; College of Computing and Data Science, Nanyang Technological University (NTU)(计算与数据科学学院,南洋理工大学) ; SMBU, Shenzhen 518172, China(深圳SMBU,越南河内VinUniversity,和新加坡NTU) ; VinUniversity, Hanoi 100000, Vietnam ; and NTU, Singapore
专题命中 音频语音多模态 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV、cs.MM、eess.AS
AI总结 提出首个跨域音视频欺骗检测基准,评估不同场景下的泛化能力,并设计MM-IDGM算法和Attention-Mixer融合方法提升性能。
Comments 17 pages