Clinical Reasoning Graphs: Structured Evaluation of LLM Diagnostic Reasoning Reveals Competence Without Consistency
临床推理图:LLM诊断推理的结构化评估揭示能力与一致性无关
专题命中 评测与基准 :LLM(title,title_cn);large language model(abstract);language model(abstract);prompting(abstract)
AI总结 通过从LLM诊断痕迹中提取结构化图(5种节点和7种边),分析50例临床病例,发现图相似性在相似病例与不相似病例间无显著差异,表明LLM具备诊断能力但缺乏推理一致性。
Comments Spotlight Paper, Proceedings of the Workshop on Structured Data for Health at the 43rd International Conference on Machine Learning (ICML), Seoul, South Korea