$C^3$ASD: Multi-Level Consistency-Driven Representation Learning
$C^3$ASD:多层次一致性驱动的表示学习
机构 * Chung-Ang University(中央大学)
专题命中 音视频/视觉语言融合 :audio-visual fusion(abstract);分类 cs.CV
AI总结 研究视频中活跃说话者检测问题,提出$C^3$ASD框架,含嵌入级、序列级和预测级一致性约束,提升跨模态表示鲁棒性,在多种损坏下有显著改进。
Comments ECCV 2026