EDVD-LLaMA: Explainable Deepfake Video Detection via Multimodal Large Language Model Reasoning
EDVD-LLaMA: 通过多模态大语言模型推理进行可解释的深度伪造视频检测
Haoran Sun, Chen Cai, Huiping Zhuang, Kong Aik Lee, Lap-Pui Chau, Yi Wang
机构
*
Department of Electrical and Electronic Engineering, The Hong Kong Polytechnic University(电子与电气工程系,香港理工大学)
;
School of Electrical and Electronic Engineering, Nanyang Technological University(电子与电气工程学院,南洋理工大学)
;
Shien-Ming Wu School of Intelligent Engineering, South China University of Technology(智能工程学院,华南理工大学)
TEn-CATG:Text-Enriched Audio-Visual Video Parsing with Multi-Scale Category-Aware Temporal Graph
Yaru Chen, Faegheh Sardari, Peiliang Zhang, Ruohao Guo, Yang Xiang, Zhenbo Li, Wenwu Wang
机构
*
Centre for Vision, Speech and Signal Processing (CVSSP), University of Surrey(视觉、语音和信号处理中心(CVSSP),萨里大学)
;
School of Computer Science and Artificial Intelligence, Wuhan University of Technology(计算机科学与人工智能学院,武汉理工大学)
;
National Key Laboratory of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(通用人工智能国家重点实验室,北京大学智能科学与技术学院)
;
College of Information and Electrical Engineering, China Agricultural University(信息与电子工程学院,中国农业大学)
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
KU Leuven(根特大学)
;
École Polytechnique Fédérale de Lausanne(洛桑联邦理工学院)
;
Carleton University(卡尔顿大学)
E-CaTCH: Event-Centric Cross-Modal Attention with Temporal Consistency and Class-Imbalance Handling for Misinformation Detection
Ahmad Mousavi, Yeganeh Abdollahinejad, Roberto Corizzo, Nathalie Japkowicz, Zois Boukouvalas
机构
*
Department of Mathematics and Statistics, American University, Washington, DC, USA(数学与统计学系,美国大学,华盛顿特区,美国)
;
Department of Computer Science and Mathematics, Pennsylvania State University, Harrisburg, PA, USA(计算机科学与数学系,宾夕法尼亚州立大学,哈里斯堡,宾夕法尼亚州,美国)
;
Department of Computer Science, American University, Washington, DC, USA(计算机科学系,美国大学,华盛顿特区,美国)
M$^3$-Med: A Benchmark for Multi-lingual, Multi-modal, and Multi-hop Reasoning in Medical Instructional Video Understanding
Shenxi Liu, Kan Li, Mingyang Zhao, Yuhang Tian, Bin Li, Shoujun Zhou, Hongliang Li, Fuxia Yang
机构
*
Beijing Institute of Technology(北京理工大学)
;
The Hong Kong Polytechnic University(香港理工大学)
;
Chinese Academy of Sciences(中国科学院)
;
Air Force Hospital of Southern Theater Command of PLA(中国人民解放军南部战区空军医院)
;
Shenzhen Traditional Chinese Medicine Hospital(深圳中医药医院)
机构
*
Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学)
;
ARC Lab, Tencent PCG(腾讯PCG ARC实验室)
;
The University of Hong Kong(香港大学)
;
Xi’an JiaoTong University(西安交通大学)