$ϕ$-DPO: Fairness Direct Preference Optimization Approach to Continual Learning in Large Multimodal Models
$ϕ$-DPO:面向大多模态模型持续学习的公平性直接偏好优化方法
机构 * CVIU Lab, University of Arkansas(阿肯色大学 CVIU 实验室) ; Dep. of Geosciences, University of Arkansas(阿肯色大学地球科学系) ; Carnegie Mellon University(卡内基梅隆大学)
专题命中 其他多模态 :multimodal(title,abstract);分类 cs.CV
AI总结 本文提出$ϕ$-DPO框架,通过直接偏好优化缓解持续学习中的灾难性遗忘问题,并解决数据不平衡导致的公平性问题,实验表明其在多个基准上表现优异。
Comments Accepted to CVPR'26