Causal Direct Preference Optimization for Distributionally Robust Generative Recommendation
因果直接偏好优化用于分布鲁棒的生成式推荐
机构 * Northeastern University, Shenyang, China(东北大学,沈阳,中国) ; Shenzhen Campus of Sun Yat-sen University, China(中山大学深圳校区,中国)
专题命中 偏好对齐 :DPO(summary_cn,abstract);alignment(abstract);分类 cs.AI
AI总结 针对直接偏好优化(DPO)在生成式推荐中放大环境混杂因素导致的虚假相关性问题,提出CausalDPO,通过因果不变性学习、后门调整和软聚类环境建模来提升分布外泛化性能。
Comments 22 pages, 3 figures