What Is Missing: Interpretable Ratings for Large Language Model Outputs
缺失的是:大型语言模型输出的可解释评分
专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);LLM(abstract);preference optimization(abstract)
AI总结 本文提出WIM评分系统,通过自然语言反馈生成可解释的评分,提升大型语言模型输出的可解释性和学习信号质量。
Comments 22 pages