KL-Regularized RLHF with Multiple Reference Models: Exact Solutions and Sample Complexity
Gholamali Aminian, Amir R. Asadi, Idan Shenfeld, Youssef Mroueh
机构
*
The Alan Turing Institute(艾伦·图灵研究所)
;
Statistical Laboratory(统计实验室)
;
University of Cambridge(剑桥大学)
;
Massachusetts Institute of Technology(麻省理工学院)
;
IBM Research USA(IBM美国研究)
专题命中
后训练与偏好优化
:RLHF(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
CommentsExtra experiments are added in new version
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China, Beijing, China(中国人民大学北京校区人工智能学院)
;
Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京大型模型与智能治理研究重点实验室)
;
Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(下一代智能搜索与推荐工程研究中心,教育部)
;
Huawei Noah’s Ark Lab, China(华为诺亚方舟实验室)
专题命中
后训练与偏好优化
:preference optimization(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
ExpandR: Teaching Dense Retrievers Beyond Queries with LLM Guidance
Sijia Yao, Pengcheng Huang, Zhenghao Liu, Yu Gu, Yukun Yan, Shi Yu, Ge Yu
机构
*
Department of Computer Science and Technology, Northeastern University, China(东北大学计算机科学与技术系)
;
Department of Computer Science and Technology, Institute for AI, Tsinghua University, China(清华大学人工智能研究院计算机科学与技术系)
;
Beijing National Research Center for Information Science and Technology, China(北京信息科学与技术国家研究中心)
专题命中
后训练与偏好优化
:LLM(title,abstract);large language model(abstract);language model(abstract);preference optimization(abstract)
Length-Controlled Margin-Based Preference Optimization without Reference Model
Gengxu Li, Tingyu Xia, Yi Chang, Yuan Wu
机构
*
School of Artificial Intelligence, Jilin University(吉林大学人工智能学院)
;
Engineering Research Center of Knowledge-Driven Human-Machine Intelligence, MOE, China(知识驱动人机智能工程研究中心,教育部,中国)
;
International Center of Future Science, Jilin University(未来科学国际中心,吉林大学)
专题命中
后训练与偏好优化
:preference optimization(title,abstract);large language model(abstract);language model(abstract);RLHF(abstract)
机构
*
Nanyang Technological University(南洋理工大学)
;
Yale University(耶鲁大学)
;
NYU Shanghai(纽约大学上海校区)
;
Alibaba-NTU Singapore Joint Research Institute(阿里巴巴-国立科技大学新加坡联合研究机构)
;
Center for Data Science New York University(纽约大学数据科学中心)
专题命中
后训练与偏好优化
:language model(title,abstract);LLM(abstract);large language model(abstract);post-training(abstract)