MedHopQA: A Disease-Centered Multi-Hop Reasoning Benchmark and Evaluation Framework for LLM-Based Biomedical Question Answering
MedHopQA: 一种以疾病为中心的多跳推理基准和评估框架,用于基于大语言模型的生物医学问答
机构 * National Library of Medicine, Division of Intramural Research(国家医学图书馆,院内研究部) ; University of Illinois at Urbana-Champaign, Department of Computer Science(伊利诺伊大学厄巴纳-香槟分校计算机科学系) ; University of Michigan Medical School(密歇根大学医学院)
AI总结 MedHopQA旨在通过多跳推理评估大语言模型在生物医学领域的表现,提供了一个以疾病为中心的基准和框架,强调组合推理、抗饱和性和抗污染性。