机构
*
Boston University(波士顿大学)
;
University of Maryland, College Park(马里兰大学学院公园分校)
;
University College London(伦敦大学学院)
;
Boston University Broad Institute of MIT and Harvard(MIT和哈佛大学波士顿大学Broad研究所)
专题命中
后训练与偏好优化
:large language model(title,abstract);language model(title,abstract);post-training(title,abstract);分类 cs.CL、cs.AI
A Survey on Post-training of Large Language Models
Guiyao Tie, Zeli Zhao, Dingjie Song, Fuyang Wei, Rong Zhou, Yurou Dai, Wen Yin, Zhejian Yang, Jiangyue Yan, Yao Su, Zhenhan Dai, Yifeng Xie, Yihan Cao, Lichao Sun, Pan Zhou, Lifang He, Hechang Chen, Yu Zhang, Qingsong Wen, Tianming Liu, Neil Zhenqiang Gong, Jiliang Tang, Caiming Xiong, Heng Ji, Philip S. Yu, Jianfeng Gao
机构
*
Huazhong University of Science and Technology(华中科技大学)
;
Lehigh University(莱斯大学)
;
The University of Hong Kong(香港大学)
;
Jilin University(吉林大学)
;
Southern University of Science and Technology(南方科技大学)
;
Worcester Polytechnic Institute(沃思堡理工学院)
;
LinkedIn Corporation(领英公司)
;
Squirrel Ai Learning
;
University of Georgia(佐治亚大学)
;
Duke University(杜克大学)
;
Michigan State University(密歇根州立大学)
;
Salesforce Research(Salesforce研究)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of Illinois at Chicago(伊利诺伊大学芝加哥分校)
;
Microsoft Research(微软研究院)
专题命中
后训练与偏好优化
:large language model(title,abstract);language model(title,abstract);post-training(title,abstract);分类 cs.CL、cs.AI
专题命中
后训练与偏好优化
:large language model(title,abstract);language model(title,abstract);preference optimization(title,abstract);分类 cs.CL、cs.LG
Journal refProceedings of the 31st International Conference on Computational Linguistics, volume 1, 2025, pages 3732-3752, Abu Dhabi, UAE. Association for Computational Linguistics
Conflict-Aware Fusion: Mitigating Logic Inertia in Large Language Models via Structured Cognitive Priors
冲突感知融合:通过结构化认知先验缓解大语言模型中的逻辑惯性
Qiming Bao, Xiaoxuan Fu, Michael Witbrock
机构
*
Xtracta & Strong AI Lab, University of Auckland(Xtracta与强人工智能实验室,奥克兰大学)
;
School of Humanities, China University of Political Science and Law(人文学院,中国政法大学)
;
Strong AI Lab, University of Auckland(强人工智能实验室,奥克兰大学)
专题命中
后训练与偏好优化
:large language model(title,abstract);language model(title,abstract);SFT(abstract,abstract_cn);LLM(abstract_cn)
Active Preference Optimization for Sample Efficient RLHF
Nirjhar Das, Souradip Chakraborty, Aldo Pacchiano, Sayak Ray Chowdhury
机构
*
Indian Institute of Science(印度科学研究院)
;
University of Maryland(马里兰大学)
;
Boston University(波士顿大学)
;
Indian Institute of Technology Kanpur(印度理工学院坎普尔分校)
专题命中
后训练与偏好优化
:RLHF(title,abstract);preference optimization(title,abstract);LLM(abstract);large language model(abstract)
CommentsAccepted at ECML-PKDD 2025. Camera ready version
CommentsThis paper contains 12 pages, 7 figures. This is an original unpublished manuscript submitted to the arXiv preprint server, with no prior publication or conference presentation