CMTA: Leveraging Cross-Modal Temporal Artifacts for Generalizable AI-Generated Video Detection
CMTA:利用跨模态时间特征进行通用的AI生成视频检测
机构 * Xi’an Jiaotong University(西安交通大学) ; The Hong Kong Polytechnic University(香港理工大学) ; Guangdong OPPO Mobile Communications Co., Ltd.(广东OPPO移动通信有限公司) ; City University of Hong Kong(香港城市大学)
专题命中 视频多模态 :cross-modal(title,abstract);分类 cs.CV、cs.MM
AI总结 本文提出CMTA框架,通过联合跨模态嵌入和多粒度时间建模,识别AI生成视频中的跨模态时间特征,验证了其在四个大规模数据集上的新状态和跨生成器泛化能力。
Comments 15 pages, 4 figures