Rethinking LLM-as-a-Judge: Representation-as-a-Judge with Small Language Models via Semantic Capacity Asymmetry
重新思考大语言模型作为评判器:通过语义能力不对称利用小语言模型进行表示作为评判器
机构 * Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司) ; University of Pittsburgh(匹兹堡大学) ; University of Maryland, College Park(马里兰大学学院公园分校) ; University of Connecticut(康涅狄格大学)
专题命中 评测与基准 :LLM(title,abstract);language model(title,abstract);small language model(title);large language model(abstract)
AI总结 研究探讨小语言模型能否作高效评估器,基于语义能力不对称假设提出“表示作为评判器”范式,通过INSPECTOR框架实例化,实验显示其在推理基准测试中性能出色,为可扩展评估提供了更优选择。
Journal ref ICLR 2026