Black Big Boxes: Tracing Adjective Order Preferences in Large Language Models
黑大盒子:在大型语言模型中追溯形容词顺序偏好
Jaap Jumelet, Lisa Bylinina, Willem Zuidema, Jakub Szymanik
机构
*
CLCG(认知语言学研究中心)
;
ILS(语言学研究所)
;
ILLC(语言学研究所)
;
CIMeC(计算机科学与工程学院)
;
University of Groningen(格罗宁根大学)
;
Utrecht University(乌得勒支大学)
;
University of Amsterdam(阿姆斯特丹大学)
;
University of Trento(特伦托大学)
专题命中
预训练与数据
:language model(title,abstract);large language model(title);分类 cs.CL
MiLe Loss: a New Entropy-Weighed Loss for Mitigating the Bias of Learning Difficulties in Large Language Models
MiLe Loss:一种新的熵加权损失,用于减轻大语言模型在学习困难方面的偏差
Zhenpeng Su, Xing Wu, Xue Bai, Zijia Lin, Hui Chen, Guiguang Ding, Wei Zhou, Songlin Hu
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)
;
Kuaishou Technology(快手科技)
;
Tsinghua University(清华大学)
专题命中
预训练与数据
:language model(title,abstract);large language model(title);分类 cs.CL
From Pretraining to Privacy: Federated Ultrasound Foundation Model with Self-Supervised Learning
从预训练到隐私:具有自监督学习的联邦超声基础模型
Yuncheng Jiang, Chun-Mei Feng, Jinke Ren, Jun Wei, Zixun Zhang, Yiwen Hu, Yunbi Liu, Rui Sun, Xuemei Tang, Juan Du, Xiang Wan, Yong Xu, Bo Du, Xin Gao, Guangyu Wang, Shaohua Zhou, Shuguang Cui, Zhen Li
机构
*
FNii-Shenzhen, The Chinese University of Hong Kong, Shenzhen(深圳FNii,香港中文大学(深圳))
;
School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(科学与工程学院,香港中文大学(深圳))
;
West China Hospital of Sichuan University, Chengdu(四川大学华西医院)
;
School of Computer Science, University College Dublin, Ireland(计算机科学学院,都柏林大学(爱尔兰))
;
College of Computer Science and Software Engineering, Shenzhen University, Shenzhen(计算机科学与软件工程学院,深圳大学)
;
South China Hospital, Health Science Center, Shenzhen University, Shenzhen(南方医院,深圳大学健康科学中心)
;
School of Computer Science, Nanjing University of Posts and Telecommunications, Nanjing(计算机科学学院,南京邮电大学)
;
Affiliated Hospital of North Sichuan Medical College, Sichuan(北川医学院附属医院)
;
North Sichuan Medical College, Sichuan(北川医学院)
;
Shenzhen Research Institute of Big Data, Shenzhen(深圳大数据研究院)
;
Bio-Computing Research Center, Harbin Institute of Technology, Shenzhen(生物计算研究中心,哈尔滨工业大学(深圳))
;
School of Computer Science, Wuhan University, Wuhan(计算机科学学院,武汉大学)
;
Computer Science Program, Computer, E(计算机科学项目,计算机)
Mask and You Shall Receive: Optimizing Masked Language Modeling For Pretraining BabyLMs
Lukas Edman, Alexander Fraser
机构
*
School of Computation, Information and Technology, TU Munich(计算、信息与技术学院,慕尼黑工业大学)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
Munich Data Science Institute(慕尼黑数据科学研究所)
Effectiveness of Large Language Models in Simulating Regional Psychological Structures: An Empirical Examination of Personality and Subjective Well-being
Ke Luoma, Li Zengyi, Liao Jiangqun, Tong Song, Peng Kaiping
专题命中
预训练与数据
:large language model(title);language model(title);LLM(abstract);分类 cs.AI