DPO-F+: Aligning Code Repair Feedback with Developers' Preferences
DPO-F+:使代码修复反馈与开发者偏好对齐
专题命中 偏好对齐 :DPO(title,title_cn);alignment(abstract)
AI总结 研究针对大语言模型在代码修复中开发者难解读输出的问题,提出DPO-f+框架,通过定义指标、构建数据集、微调模型及评估反馈质量,提升反馈准确性与对齐度,增强了代码理解和人机协作。
Comments 10 pages, 2 figures