Benchmark Shadows: Data Alignment, Parameter Footprints, and Generalization in Large Language Models
基准阴影:大型语言模型中的数据对齐、参数足迹与泛化
机构 * Vivo AI Lab, Shenzhen, China(维沃人工智能实验室,深圳,中国) ; Hong Kong University of Science and Technology, Hong Kong, China(香港科技大学,香港,中国)
专题命中 多模态评测 :multimodal(abstract)
AI总结 本文研究了大型语言模型中基准表现与广度能力之间的差异,通过数据干预发现数据分布影响参数适应与泛化能力,提出参数空间诊断方法揭示不同训练模式的结构特征。
Comments 28 pages, 26 figures, 8 tables