Melissa Z. Pan, Negar Arabzadeh, Riccardo Cogo, Yuxuan Zhu, Alexander Xiong, Lakshya A Agrawal, Huanzhi Mao, Emma Shen, Sid Pallerla, Liana Patel, Shu Liu, Tianneng Shi, Xiaoyuan Liu, Jared Quincy Davis, Emmanuele Lacavalla, Alessandro Basile, Shuyi Yang, Paul Castro, Daniel Kang, Koushik Sen, Dawn Song, Joseph E. Gonzalez, Ion Stoica, Matei Zaharia, Marquita Ellis
机构
*
University of California at Berkeley(加州大学伯克利分校)
;
IBM Research(IBM研究院)
;
University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Stanford University(斯坦福大学)
VALUEFLOW: Toward Pluralistic and Steerable Value-based Alignment in Large Language Models
VALUEFLOW:迈向大语言模型中多元化和可引导的基于价值的对齐
Woojin Kim, Sieun Hyeon, Jusang Oh, Jaeyoung Do
机构
*
Department of Electrical and Computer Engineering, Seoul National University(首尔国立大学电气与计算机工程系)
;
Interdisciplinary Program in Artificial Intelligence, Seoul National University(首尔国立大学人工智能交叉学科项目)
Conflicting Biases at the Edge of Stability: Norm versus Sharpness Regularization
稳定性边缘的冲突偏差:范数与锐度正则化
Maria Matveev, Vit Fojtik, Hung-Hsu Chou, Gitta Kutyniok, Johannes Maly
机构
*
Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)
;
Prusa Research(普拉萨研究公司)
;
Institute for Robotics and Mechatronics, DLR-German Aerospace Center(德国航空航天中心机器人与机电研究所)
Finding the Minimal Parameter Budget for Implicit Reasoning: A Data Complexity Driven Scaling Law for Language Models
寻找隐式推理的最小参数预算:一种基于数据复杂度的语言模型缩放定律
Xinyi Wang, Shawn Tan, Shenbo Xu, Mingyu Jin, William Yang Wang, Rameswar Panda, Yikang Shen
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
University of Cambridge(剑桥大学)
;
University of Washington(华盛顿大学)
;
University of Toronto(多伦多大学)
;
University of Tokyo(东京大学)