Rethinking LLM-as-a-Judge: Representation-as-a-Judge with Small Language Models via Semantic Capacity Asymmetry
重新思考大语言模型作为评判器:通过语义能力不对称利用小语言模型进行表示作为评判器
Zhuochun Li, Yong Zhang, Ming Li, Yuelyu Ji, Yiming Zeng, Ning Cheng, Yun Zhu, Yanmeng Wang, Shaojun Wang, Jing Xiao, Daqing He
机构
*
Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司)
;
University of Pittsburgh(匹兹堡大学)
;
University of Maryland, College Park(马里兰大学学院公园分校)
;
University of Connecticut(康涅狄格大学)
机构
*
State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(信息多媒体国家重点实验室,计算机学院,北京大学)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
Institute for Brain and Intelligence, Fudan University(脑与智能研究院,复旦大学)
;
University of Science and Technology Beijing(北京科技大学)
;
Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心)
Digital Twin Driven Textile Classification and Foreign Object Recognition in Automated Sorting Systems
数字孪生驱动的自动化分拣系统中的纺织品分类与异物识别
Serkan Ergun, Tobias Mitterer, Hubert Zangl
机构
*
Institute of Smart Systems Technologies(智能系统技术研究所)
;
University of Klagenfurt(克雷格弗特大学)
;
AAU SAL USE Laboratory(AAU SAL USE实验室)
;
Silicon Austria Labs(硅 Austria 实验室)
Does Explanation Correctness Matter? Linking Computational XAI Evaluation to Human Understanding
解释正确性是否重要?将计算XAI评估与人类理解联系起来
Gregor Baer, Chao Zhang, Isel Grau, Pieter Van Gorp
机构
*
Information Systems Group, Eindhoven University of Technology(埃因霍温理工大学信息系统组)
;
Human-Technology Interaction Group, Eindhoven University of Technology(埃因霍温理工大学人机交互组)
机构
*
National Engineering Research Center for Software Engineering, Peking University(北京大学软件工程国家工程研究中心)
;
Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院)
;
Tsinghua University(清华大学)
;
Chinese Academy of Sciences(中国科学院)
;
University of British Columbia(不列颠哥伦比亚大学)
;
Renmin University of China(中国人民大学)