Recovering Diversity Without Losing Alignment: A DPO Recipe for Post-Trained LLMs
在不损失对齐的情况下恢复多样性:面向后训练大语言模型的DPO配方
机构 * University of Maryland, College Park(马里兰大学 College Park 分校)
专题命中 偏好对齐 :DPO(title,title_cn);alignment(title,abstract);safety(abstract);分类 cs.CL
AI总结 提出REDIPO数据构建流程,通过离线DPO从基础模型生成中恢复多样性答案,同时保持指令模型的对齐性能。
Comments Under Review. 26 pages, 3 figures, 16 tables