CLARA: Clip-Level Multimodal Alignment with VLM-Derived Rationales for Hateful Video Detection
CLARA:基于VLM衍生理由的片段级多模态对齐用于仇恨视频检测
机构 * Institute for Analytics and Data Science, University of Essex(埃塞克斯大学分析与数据科学研究所) ; University of Exeter(埃克塞特大学) ; Queen Mary University of London(伦敦大学玛丽皇后学院)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.MM
AI总结 本研究提出CLARA框架,以片段级多模态对齐结合VLM衍生理由,在三个仇恨视频数据集上实现了优于现有最优方法的仇恨视频检测性能。