LLM Essay Scoring Under Holistic and Analytic Rubrics: Prompt Effects and Bias
基于整体和分析评分标准的LLM作文评分:提示效应与偏见
机构 * Faculty of Mathematics and Information Science, Warsaw University of Technology(华沙理工大学数学与信息科学学院) ; University of Wolverhampton(伍尔弗汉普顿大学)
专题命中 指令微调 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 研究评估了指令微调LLM在三种开放性作文评分数据集上的表现,发现整体评分与人类一致,但分析评分存在显著偏见,尤其在低阶关注点如语法上表现更严厉,且简洁提示优于长格式提示。
Journal ref Computational Science - ICCS 2026, Lect. Notes Comput. Sci. 16789 (2026) 531-546