PRPO: Paragraph-level Policy Optimization for Vision-Language Deepfake Detection
PRPO:用于视觉-语言深度伪造检测的段级策略优化
机构 * Qatar Computing Research Institute, Hamad Bin Khalifa University, Doha, Qatar(卡塔尔计算研究所,哈马德·本·哈利法大学,多哈) ; New Jersey Institute of Technology, NJ, USA(新泽西理工学院)
专题命中 视觉定位与Grounding :grounding(abstract);multimodal large language model(abstract);分类 cs.CV、cs.LG
AI总结 本文提出PRPO算法,通过段级相对策略优化提升深度伪造检测的准确性与推理能力,实验显示其在检测准确率和推理评分上均显著优于现有方法。
Comments Accepted at ICML 2026