Topology-Enhanced Alignment for Large Language Models: Trajectory Topology Loss and Topological Preference Optimization
基于拓扑的大型语言模型对齐:轨迹拓扑损失与拓扑偏好优化
Yurui Pan, Ke Xu, Bo Peng
机构
*
School of Computing and Intelligent Innovation, Fudan University(复旦大学计算与智能创新学院)
;
School of Economics and Management, Tongji University(同济大学经济与管理学院)
;
College of Information Technology, Shanghai Ocean University(上海海洋大学信息学院)
专题命中
后训练与偏好优化
:large language model(title,abstract);language model(title,abstract);preference optimization(title,abstract);LLM(summary_cn,abstract)
机构
*
The Hong Kong Polytechnic University (PolyU)(香港理工大学)
;
Zhejiang University(浙江大学)
;
PolyU-Daya Bay Technology and Innovation Research Institute(香港理工大学-大亚湾技术与创新研究院)
专题命中
后训练与偏好优化
:LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);preference optimization(title,abstract)
The Neutral Mask: How RLHF Provides Shallow Alignment while Leaving Partisan Structure Intact in a Large Language Model
中性面具:RLHF如何提供浅层对齐而保留大语言模型中的党派结构
Wendy K. Tam
机构
*
Vanderbilt University(范德堡大学)
;
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
National Center for Supercomputing Applications(国家超级计算应用中心)
专题命中
后训练与偏好优化
:RLHF(title,title_cn);large language model(title,abstract);language model(title,abstract);分类 cs.CL
机构
*
Department of Electrical and Computer Engineering(电气与计算机工程系)
;
New Jersey Institute of Technology(新泽西理工学院)
;
Department of Computer Engineering(计算机工程系)
;
Heritage Institute of Technology(遗产理工学院)
专题命中
后训练与偏好优化
:RLHF(title,title_cn);LLM(title,abstract);large language model(abstract);language model(abstract)
机构
*
Soochow University(苏州大学)
;
Microsoft Research Asia(微软亚洲研究院)
;
Peking University(北京大学)
;
Stony Brook University(石溪大学)
;
The University of Chicago(芝加哥大学)
From Prompting to Preference Optimization: A Comparative Study of LLM-based Automated Essay Scoring
从提示到偏好优化:基于LLM的自动作文评分方法比较研究
Minh Hoang Nguyen, Vu Hoang Pham, Xuan Thanh Huynh, Phuc Hong Mai, Vinh The Nguyen, Quang Nhut Huynh, Huy Tien Nguyen, Tung Le
机构
*
Faculty of Information Technology, University of Science, Ho Chi Minh City, Vietnam(信息科技学院,科学大学,胡志明市,越南)
;
Vietnam National University, Ho Chi Minh City, Vietnam(越南国家大学,胡志明市,越南)
专题命中
后训练与偏好优化
:LLM(title,abstract);preference optimization(title,abstract);prompting(title,abstract);large language model(abstract)
机构
*
The Hong Kong Polytechnic University, PolyU(香港理工大学,PolyU)
;
The Hong Kong University of Science and Technology, HKUST(香港科学与技术大学,HKUST)
;
PolyU-Daya Bay Technology and Innovation Research Institute(PolyU-大亚湾技术与创新研究院)
专题命中
后训练与偏好优化
:LLM(title,title_cn);post-training(title,abstract);large language model(abstract);language model(abstract)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
University of Oxford(牛津大学)
;
Imperial College London(伦敦帝国学院)
;
University of Georgia(佐治亚大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Chinese Academy of Sciences(中国科学院)
;
Dalian University of Technology(大连理工大学)
;
National University of Singapore(新加坡国立大学)
;
Wuhan University(武汉大学)
专题命中
后训练与偏好优化
:LLM(title,title_cn);post-training(title,abstract);large language model(abstract);language model(abstract)
Tracing the Representation Geometry of Language Models from Pretraining to Post-training
Melody Zixuan Li, Kumar Krishna Agrawal, Arna Ghosh, Komal Kumar Teru, Adam Santoro, Guillaume Lajoie, Blake A. Richards
机构
*
Computer Science, McGill University(麦吉尔大学计算机科学系)
;
Mila - Quebec AI Institute(魁北克人工智能研究所)
;
UC Berkeley(加州大学伯克利分校)
;
G o o g l e , Paradigms of Intelligence Team(谷歌,智能范式团队)
;
Mathematics and Statistics, Université de Montréal(蒙特利尔大学数学与统计学系)
;
Neurology & Neurosurgery and Montreal Neurological Institute, McGill University(神经病学与神经外科及蒙特利尔神经研究所,麦吉尔大学)
;
CIFAR Learning in Machines & Brains Program(CIFAR 机器与大脑学习计划)
专题命中
后训练与偏好优化
:language model(title,abstract);pretraining(title,abstract);post-training(title,abstract);large language model(abstract)