g-DPO: Scalable Preference Optimization for Protein Language Models
g-DPO:可扩展的偏好优化用于蛋白质语言模型
机构 * Cradle ML Team(Cradle团队) ; Cradle Zürich, Switzerland(Cradle瑞士苏黎世)
专题命中 偏好对齐 :DPO(title,abstract);分类 cs.LG
AI总结 g-DPO通过序列聚类和组近似方法提升蛋白质语言模型的偏好优化效率,实现更快的收敛速度和与标准DPO相当的性能。
Comments Accepted at two workshops: FM4LS NeurIPS 2025 (accepted-paper.html" target="_blank" rel="noopener">https://nips2025fm4ls.github.io/pages/accepted-paper.html) and MLSB in Copenhagen EurIPS 2025