A Scoping Review of LLM-as-a-Judge in Healthcare and the MedJUDGE Framework
对LLM-as-a-Judge在医疗领域的综述及MedJUDGE框架
Chenyu Li, Zohaib Akhtar, Mingu Kwak, Yuelyu Ji, Hang Zhang, Tracey Obi, Yufan Ren, Xizhi Wu, Sonish Sivarajkumar, Harold P. Lehmann, Shyam Visweswaran, Michael J. Becich, Danielle L. Mowery, Renxuan Liu, Haoyang Sun, Yanshan Wang
机构
*
Department of Biomedical Informatics, School of Medicine, University of Pittsburgh(匹兹堡大学医学院生物医学信息学系)
;
Department of Health Information Management, School of Health and Rehabilitation Sciences, University of Pittsburgh(匹兹堡大学健康与康复科学学院健康信息管理系)
;
OpenCura, Health Innovation Consortium(OpenCura健康创新联盟)
;
Northwestern University, Kellogg School of Management(西北大学凯洛格管理学院)
;
Intelligent Systems Program, School of Computing and Information, University of Pittsburgh(匹兹堡大学计算与信息学院智能系统项目)
;
Johns Hopkins University School of Medicine Biomedical Informatics and Data Science(约翰霍普金斯大学医学院生物医学信息学与数据科学)
;
Clinical and Translational Science Institute, University of Pittsburgh(匹兹堡大学临床与转化科学研究所)
;
Institute for Biomedical Informatics, University of Pennsylvania(宾夕法尼亚大学生物医学信息学研究所)
;
Data Science, School of Computing and Information, University of Pittsburgh(匹兹堡大学计算与信息学院数据科学)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Learning to Ask: When LLM Agents Meet Unclear Instruction
学习提问:当LLM代理遇见模糊指令
Wenxuan Wang, Juluan Shi, Zixuan Ling, Yuk-Kit Chan, Chaozheng Wang, Cheryl Lee, Youliang Yuan, Jen-tse Huang, Wenxiang Jiao, Michael R. Lyu
机构
*
Renmin University of China(中国人民大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学深圳校区)
;
Johns Hopkins University(约翰霍普金斯大学)
;
Xiaohongshu Inc.(小红书公司)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
机构
*
Stanford University(斯坦福大学)
;
Shenzhen University(深圳大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
City University of Hong Kong(香港城市大学)
;
Renmin University of China(中国人民大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);prompting(abstract)
Information Extraction from Electricity Invoices with General-Purpose Large Language Models
从电力账单中提取信息:通用大型语言模型
Javier Gómez, Javier Sánchez
机构
*
Centro de Tecnologías de la Imagen (CTIM)(图像技术中心)
;
Instituto Universitario de Cibernética, Empresas y Sociedad (IUCES)(大学网络研究所、企业与社会)
;
University of Las Palmas de Gran Canaria(大加那利岛大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);prompting(abstract)
aLLoyM: A large language model for alloy phase diagram prediction
aLLoyM:一种用于合金相图预测的大型语言模型
Yuna Oikawa, Guillaume Deffrennes, Taichi Abe, Ryo Tamura, Koji Tsuda
机构
*
Graduate School of Frontier Sciences, The University of Tokyo(东京大学前沿科学研究院)
;
University Grenoble Alpes, CNRS, Grenoble INP, SIMaP(格勒诺布尔阿尔卑斯大学、CNRS、格勒诺布尔INP、SIMaP)
;
Research Center for Structural Materials, National Institute for Materials Science(材料研究所结构材料研究中心)
;
Center for Basic Research on Materials, National Institute for Materials Science(材料研究所基础材料研究中心)
;
RIKEN Center for Advanced Intelligence Project(理化学研究所先进人工智能项目中心)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI
机构
*
Center for Data Science, New York University Shanghai(纽约大学上海数据科学中心)
;
Courant Institute of Mathematical Sciences, New York University(纽约大学Courant数学科学研究所)
;
School of Data Science, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)数据科学学院)
专题命中
评测与基准
:LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL
Large Language Models for Multilingual Code Intelligence: A Survey
大型语言模型用于多语言代码智能:综述
Chao Jiang, Dugang Liu, Cheng Wen, Zhiwu Xu, Hua Zheng, Muhammad Sadiq, Jawwad Ahmed Shamsi, Shengchao Qin, Zhong Ming
机构
*
College of Computer Science and Software Engineering, Shenzhen University, China(深圳大学计算机科学与软件工程学院,中国)
;
Guangzhou Institute of Technology, Xidian University, China(广州理工大学,西安电子科技大学,中国)
;
Guangzhou University of Software, China(广州软件大学,中国)
;
Shenzhen University of Information Technology(深圳信息大学)
;
National University of Computer and Emerging Sciences Karachi, Pakistan(巴基斯坦卡拉奇国家计算机与新兴科学大学)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.LG
Beyond Text-Dominance: Understanding Modality Preference of Omni-modal Large Language Models
超越文本主导:理解多模态大语言模型的模态偏好
Xinru Yan, Boxi Cao, Yaojie Lu, Hongyu Lin, Weixiang Zhou, Le Sun, Xianpei Han
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
Chinese Information Processing Laboratory(中文信息处理实验室)
;
Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);分类 cs.AI
Is Human-Like Text Liked by Humans? Multilingual Human Detection and Preference Against AI
人类风格的文本是否受到人类欢迎?多语言人类检测与对抗AI的偏好
Yuxia Wang, Rui Xing, Jonibek Mansurov, Giovanni Puccetti, Zhuohan Xie, Minh Ngoc Ta, Jiahui Geng, Jinyan Su, Mervat Abassy, Saad El Dine Ahmed, Kareem Elozeiri, Nurkhan Laiyk, Maiya Goloburda, Tarek Mahmoud, Raj Vardhan Tomar, Alexander Aziz, Ryuto Koike, Masahiro Kaneko, Artem Shelmanov, Ekaterina Artemova, Vladislav Mikhailov, Akim Tsvigun, Alham Fikri Aji, Nizar Habash, Iryna Gurevych, Preslav Nakov
机构
*
MBZUAI
;
Nebius AI
;
KU Leuven
;
University of Oslo(奥斯陆大学)
;
ISTI-CNR
;
Toloka AI
;
New York University Abu Dhabi(纽约大学阿布扎比分校)
;
BKAI Research Center, Hanoi University of Science and Technology(BKAI研究所以内大学科学技术大学)
;
Cornell University(康奈尔大学)
;
Zewail City of Science and Technology(泽韦尔科学与技术城)
;
TU Darmstadt(图鲁姆大学)
;
CIC, University of Delhi(CIC,德里大学)
;
Alexandria University(亚历山大大学)
;
University of Florida(佛罗里达大学)
;
Institute of Science Tokyo(东京科学研究院)
专题命中
评测与基准
:LLM(abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)
机构
*
Transcengram
;
Beihang University(北京航空航天大学)
;
The University of Hong Kong(香港大学)
;
Shenzhen Loop Area Institute(深圳河套学院)
;
ShanghaiTech University(上海科技大学)
;
DeepSeek
;
University of California, Berkeley(加州大学伯克利分校)
专题命中
评测与基准
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL
William Walden, Marc Mason, Orion Weller, Laura Dietz, John Conroy, Neil Molino, Hannah Recknor, Bryan Li, Gabrielle Kaili-May Liu, Yu Hou, Dawn Lawrie, James Mayfield, Eugene Yang
机构
*
Johns Hopkins University(约翰霍普金斯大学)
;
University of New Hampshire(新罕布什尔大学)
;
IDA Center for Computing Services(IDA计算服务中心)
;
Google(谷歌)
;
Yale University(耶鲁大学)
;
University of Maryland(马里兰大学)