Face and Voice Cross-modal Association with Learning Convex Feature Embedding
基于凸特征嵌入学习的人脸与声音跨模态关联
专题命中 音频语音多模态 :cross-modal(title,abstract);分类 cs.CV
AI总结 本文提出结合跨模态注意力机制的凸特征嵌入方法,解决人脸与声音跨模态关联中的特征异质性问题,在VoxCeleb数据集的相关任务上较现有方法有显著提升。
Journal ref Multimedia Systems, vol. 31, no. 4, pp. 296, July 2025