Shapley-based Data Valuation for LLM Alignment via Sequential Preference Optimization
基于Shapley值的大语言模型对齐数据估值:通过顺序偏好优化
机构 * Criteo AI lab(Criteo AI实验室) ; FairPlay joint team(FairPlay联合团队) ; CREST ; ENSAE ; Institut Polytechnique de Paris(巴黎理工学院) ; Inria(法国国家科学与技术研究院)
专题命中 后训练与偏好优化 :LLM(title,abstract);preference optimization(title,abstract);large language model(abstract);language model(abstract)
AI总结 研究大语言模型对齐中数据估值问题,针对基于Shapley值估值计算量大的挑战,提出顺序偏好优化方法,可高效近似Shapley值,计算真实偏好数据集的Shapley值并揭示各源对模型对齐的作用。