Beyond Uniform Forgetting: A Study of Sequential Direct Preference Optimization Across Preference Settings
超越统一遗忘:不同偏好设置下顺序直接偏好优化的研究
Pranav Bhandari, Nicolas Fay, Amitava Datta, Usman Naseem, Mehwish Nasim
机构
*
Network Analysis and Social Influence Modelling (NASIM) Lab(网络分析与社会影响建模实验室)
;
School of Physics Maths and Computing, The University of Western Australia(西澳大学物理数学与计算学院)
;
School of Psychological Science, The University of Western Australia(西澳大学心理科学学院)
;
School of Computing, Macquarie University(麦考瑞大学计算机学院)
Apparent Psychological Profiles of Large Language Models are Largely a Measurement Artifact
大语言模型的心理特征很大程度上是测量假象
Jelena Meyer, David Garcia, Dirk U. Wulff
机构
*
Max Planck Institute for Human Development(马克斯·普朗克人类发展研究所)
;
University of Konstanz(康斯坦茨大学)
;
Barcelona Supercomputing Center(巴塞罗那超级计算中心)
;
University of Basel(巴塞尔大学)