arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

共收录 1658 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 诊断辅助 432 篇

2607.24814 2026-07-29 cs.AI cs.LG q-bio.OT 新提交 75%

Aletheia: An Offline-First Clinical Decision Support System for Differential Diagnosis in Low-Resource Healthcare Settings

Aletheia:用于低资源医疗环境中鉴别诊断的离线优先临床决策支持系统

Joseph Walusimbi, Ann Move Oguti, Abubakhari Sserwadda, Precious Boss Kasasira, Charles Brian Okoboi

机构 * Soroti University(索罗蒂大学)

专题命中 诊断辅助 :diagnosis(title);分类 cs.LG、q-bio

AI总结 针对撒哈拉以南非洲低资源医疗环境,提出基于Qwen2.5 - 3B - Instruct并经QLoRA微调的Aletheia临床决策支持系统,评估显示其在诊断准确率等指标上表现良好,证明在无云设施的资源受限环境初级保健层部署大语言模型临床推理的可行性。

Comments 8 pages, 11 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15910 2026-06-16 cs.CL 新提交 75%

Calibrated Triage, Not Autonomy: Confidence Estimation for Medical Vision-Language Models

校准的分诊,而非自主:医学视觉-语言模型的置信度估计

Reza Khanmohammadi, Kundan Thind, Mohammad M. Ghassemi

机构 * Michigan State University(密歇根州立大学)

专题命中 诊断辅助 :medical image(abstract);pathology(abstract);radiology(abstract)

AI总结 针对医学视觉-语言模型在回答时可能忽略图像而依赖语言先验的问题,提出使用置信度估计进行校准分诊,通过评估七种置信度估计器,发现高置信度区域是区分可用估计器的关键,最佳探针可将错误率从41-45%降至1-4%,但无估计器在所有领域和模型中一致最优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14109 2026-08-17 cs.AI cs.LG cs.MA 新提交 74%

A Graph-Based Reinforcement Learning Framework for Structured Drift Diagnosis and Recovery in Autonomous LLM Agents

面向自主大语言模型智能体中结构化漂移诊断与恢复的基于图的强化学习框架

Ismail El Hamraoui, Sagar Jose, Nicolas Bureau, Robert Plana

专题命中 诊断辅助 :diagnosis(title);分类 cs.LG

AI总结 本研究针对自主LLM智能体的运行时行为漂移问题,提出基于图的强化学习即插即用恢复框架,经AppWorld基准验证,该框架可利用漂移信息做出正确恢复决策且输出符合要求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09842 2026-08-11 cs.CV 新提交 74%

From Diagnosis to Correction: Benchmarking and Improving Real-World Table Parsing

从诊断到修正:真实世界表格解析的基准测试与改进

Jutao Xiao, Yuan Qu, Dongsheng Ma, Fan Wu, Tianyao He, Weihong Li, Jie Yang, Yu Qiao, Bin Wang, Conghui He

机构 * Zhejiang University(浙江大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Peking University(北京大学)

专题命中 诊断辅助 :diagnosis(title);分类 cs.CV

AI总结 本文针对真实世界表格解析的缺陷,构建诊断基准TableParseMap,提出DEC框架,无需重训即可提升冻结解析器性能,在TableParseMap上TEDS获显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29530 2026-08-03 cs.LG 新提交 74%

A Neurosymbolic Approach for Explainable Early Diagnosis of Alzheimer's Disease

一种用于阿尔茨海默病可解释早期诊断的神经符号方法

Ranveer Singh, Pranuthi Tenali, Saurabh Mathur, Ameet Soni, Vaishali Phatak, Karla Lynch, Daniel Murman, Matthew Rizzo, Sriraam Natarajan

专题命中 诊断辅助 :diagnosis(title);分类 cs.LG

AI总结 该研究提出一种自动化流程,用预训练基础模型处理言语流畅性测试音频构建贝叶斯网络,以实现阿尔茨海默病的可解释早期诊断,成功恢复临床知识并识别语言标志物间新关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26519 2026-07-30 eess.SP 新提交 74%

A Data-Driven Vibration Analysis Framework for Micro-Motor Fault Diagnosis and Quality Control

一种用于微电机故障诊断与质量控制的数据驱动振动分析框架

Xuan Chen, Xinjun Zuo, Yancheng Bi, Shunli Yu, Yunqi Cao

专题命中 诊断辅助 :diagnosis(title);分类 eess.SP

AI总结 本研究针对电动牙刷微电机故障诊断与质量控制需求,设计振动信号采集装置,结合RF特征选择与SVM分类模型,实现微电机故障的精准高效检测,多项性能指标优异。

Comments 6 pages, 4 figures, and 1 table. Accepted by the 37th Chinese Process Control Conference (CPCC 2026); to appear in the conference proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24401 2026-07-28 stat.ML cs.LG 新提交 74%

proxymate: Diagnosis and Adjustment of Proxy Estimates for Reliable Inference

Proxymate:用于可靠推断的代理估计诊断与调整

Alexandra N. M. Darmon, Deeksha Sinha, Steve Wilkins-Reeves, Caner Gocmen

专题命中 诊断辅助 :diagnosis(title);分类 cs.LG

AI总结 研究针对代理估计存在的问题,提出Proxymate框架及Python包,通过四个级别进行代理验证和调整,提供诊断与策略,在Meta多个用例中应用,校正大量代理与主要单元比较,推动多工作流发布。

Comments 15 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03150 2026-07-07 eess.AS cs.LG 新提交 74%

An Intervention-Based Framework for Shortcut Diagnosis in Spoofing Countermeasures

面向欺骗对抗系统的基于干预的捷径诊断框架

Santiago Rubio, Pilar Bello, Dayana Ribas, Antonio Miguel, Eduardo Lleida, Alfonso Ortega

机构 * University of ZaragozaSpain(萨拉戈塔大学西班牙) Business Telecommunications ServicesSpain(业务电信服务西班牙) ViVoLab, Aragón Institute for Engineering Research (I3A)(ViVoLab,阿拉贡工程研究院(I3A))

专题命中 诊断辅助 :diagnosis(title);分类 cs.LG

AI总结 针对深度伪造音频检测系统因数据集捷径伪影导致野外可靠性下降的问题,提出基于有向图模型的干预诊断框架,可区分捷径依赖与合法域偏移,明确非语音区间是主导捷径。

Comments Accepted at Odyssey 2026: The Speaker and Language Recognition Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18326 2026-06-18 cs.LG 新提交 74%

Neural Network Implementation of the Renormalization Group for Fault Diagnosis with Class Imbalance

基于重正化群神经网络的类别不平衡故障诊断

Evgeny Nikulchev, Dmitry Ilin

机构 * MIREA – Russian Technological University(莫斯科俄罗斯技术大学)

专题命中 诊断辅助 :diagnosis(title);分类 cs.LG

AI总结 提出RGNet,一种基于重正化群概念的神经网络架构,通过层次化粗粒化特征空间处理类别不平衡和多维噪声,在AI4I数据集上验证了其有效性。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15559 2026-06-16 cs.SE cs.DC cs.LG 新提交 74%

SDVDiag: Multimodal Causal Discovery for Online Diagnosis in Software-defined Vehicles

SDVDiag:软件定义车辆中用于在线诊断的多模态因果发现

Matthias Weiß, Athreya Hosahalli Prakash, Falk Dettinger, Nasser Jazdi, Michael Weyrich

机构 * University of Erlangen-Nuremberg(埃尔兰根-纽伦堡大学) Fraunhofer Institute for Software and Virtual Systems(弗劳恩霍夫软件与虚拟系统研究所)

专题命中 诊断辅助 :diagnosis(title);分类 cs.LG

AI总结 提出SDVDiag多模态因果发现管道,融合日志和指标表示构建因果图,结合异常触发实现持续在线诊断,在自动泊车测试中因果图更稀疏,根因定位准确。

Comments 8 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09899 2026-06-10 cs.LG cs.AI 新提交 74%

When Attribution Patching Lies: Diagnosis and a Second-Order Correction

当归因补丁说谎时:诊断与二阶修正

Luyang Zhang, Jialu Wang

机构 * Carnegie Mellon University(卡内基梅隆大学) University of California, Santa Cruz(加州大学圣克鲁兹分校)

专题命中 诊断辅助 :diagnosis(title);分类 cs.LG

AI总结 研究归因补丁(梯度一阶近似)在机制可解释性中的不可靠性,发现主要误差源于下游网络的非线性,并提出可靠性评分、误差界和HVP二阶修正方法。

Comments 30 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06871 2026-06-08 cs.LG 新提交 74%

Evidence-Grounded Ensemble Diagnosis of 802.11 Packet Captures: A Multi-Stage Pipeline with Deterministic Reliability Scoring

基于证据的802.11数据包捕获集成诊断:具有确定性可靠性评分的多阶段流水线

Jerome Henry, Swadhin Pradhan, Miroslav Popovic

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 诊断辅助 :diagnosis(title);分类 cs.LG

AI总结 提出PROBE多阶段流水线,通过确定性证据框架和集成方法解决LLM在802.11诊断中的幻觉、置信度偏差和评估偏见问题,在87个企业Wi-Fi捕获上实现0.957的加权证据F1分数和96%的自动接受率。

Comments 37 pages, 9 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06804 2026-06-08 cs.LG stat.AP 新提交 74%

Interpreting Learning Under Competing Models: Joint and Stepwise Approaches for Dynamic Cognitive Diagnosis

解释竞争模型下的学习:动态认知诊断的联合与逐步方法

Yawen Ma, Sahoko Ishida, Kate Cain, Gabriel Wallin

机构 * School of Mathematical Sciences, Lancaster University(兰卡斯特大学数学科学学院) Department of Computer Science, University of Oxford(牛津大学计算机科学系) Department of Psychology, Lancaster University(兰卡斯特大学心理学系)

专题命中 诊断辅助 :diagnosis(title);分类 cs.LG

AI总结 研究在项目-技能结构未知时,联合估计Q矩阵与学习过程相比先确定Q矩阵再研究学习,如何改变对学习者发展的结论,并通过动态认知诊断模型分析阅读游戏数据,发现联合分析更可靠。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17691 2026-07-21 eess.IV cs.CV cs.ET 新提交 73%

Luminosity-Adaptive Contrast Enhancement Using CLAHE for Retinal Fundus Images with Quantitative Validation and Comparative Analysis

使用对比度受限自适应直方图均衡化(CLAHE)对视网膜眼底图像进行亮度自适应对比度增强,并进行定量验证和比较分析

K. Mithra, Prem Kumar Santhanam

机构 * Independent Researcher, Department of Information and Computer Engineering, Scottsdale, AZ, USA(独立研究者,信息与计算机工程系,斯科茨代尔,亚利桑那州,美国) Seidenberg School of Computer Science and Information Systems, Pace University, New York City, NY, USA(塞登堡计算机科学与信息系统学院,帕克大学,纽约市,纽约州,美国)

专题命中 诊断辅助 :pathology(abstract);diagnosis(abstract);分类 cs.CV、eess.IV

AI总结 该研究针对视网膜眼底图像因光照等问题影响诊断的情况,提出结合HSV颜色空间分解亮度校正与CLAHE的两阶段图像增强流程,经实验验证其在对比度和结构保真度上优于传统方法,处理速度适配临床筛查。

Comments 11 pages

Journal ref Journal of Intelligent Medicine and Healthcare 2026, 4, 87-97

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07899 2026-08-11 cs.AI 新提交 71%

TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?

TelemetrySuffBench:智能体遥测是否足以用于故障起源诊断?

Yuxuan Zhu, Peng Pu

专题命中 诊断辅助 :diagnosis(title)

AI总结 该研究推出TelemetrySuffBench基准,评估五个前沿语言模型的故障起源诊断能力,发现检测与定位存在差距,安全弃权(不执行)具强模型依赖性,需决策-来源链接与弃权保障。

Comments 10 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03114 2026-08-05 econ.TH cs.AI cs.CY 新提交 71%

Optimal Liability Design for Medical AI

医疗人工智能的最优责任设计

Rui Mao, Tingliang Huang, Houcai Shen

专题命中 诊断辅助 :medical AI(title)

AI总结 本文构建委托代理模型研究医疗AI的最优责任设计,发现不对称信息下最优责任为统一水平,AI准确度与最优责任呈非单调关系,信息不对称是双刃剑,透明度对各利益相关者影响不均。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03735 2026-08-05 cs.MA cs.CL 新提交 71%

An Actionable Diagnosis of Multilingual, Multi-Agent Planning Failures

多语言多智能体规划失败的可操作诊断

Vikas Pahuja, Jonathan Brokman, Omer Hofman, Tamir Nizri, Daniel Vishna, Seraphina Goldfarb-Tarrant, Kelly Marchisio, Hisashi Kojima, Roman Vainshtein

专题命中 诊断辅助 :diagnosis(title)

AI总结 本研究针对多语言多智能体系统在非英语场景下的规划失败问题,提出规划-接地失败分类法,开发TART方法,在多语言任务中显著提升了现有系统的性能。

Comments 22 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03475 2026-08-05 cs.MM cs.AI cs.CL 新提交 71%

Adaptive Modality Reliability Diagnosis and Restoration for Robust Multimodal Intent Recognition

用于鲁棒多模态意图识别的自适应模态可靠性诊断与恢复

Suraj Kumar, Mohnish Raj, Soumi Chattopadhayay, Chandranath Adak, Ayan Dutta

专题命中 诊断辅助 :diagnosis(title)

AI总结 提出PRIME闭环可靠性引导框架,通过诊断恢复多模态意图识别的不可靠模态,在保持干净数据性能的同时提升了多模态数据各类退化场景下的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28906 2026-08-03 cs.CL 新提交 71%

Token-Level Diagnosis of Sycophancy in LLMs with Attribution-Guided Steering

基于归因引导调控的大语言模型谄媚行为的令牌级诊断

Hieu Nguyen, Mahammed Kamruzzaman, Anshuman Chhabra, Gene Louis Kim

专题命中 诊断辅助 :diagnosis(title)

AI总结 本研究针对大语言模型的谄媚行为,提出基于集成梯度的权威份额指数进行令牌级归因诊断,构建调控向量实现推理时无重训的谄媚缓解,使最极端案例的谄媚率从96%降至25%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27384 2026-07-31 cs.CL cs.AI 新提交 71%

Same Facts, Different Diagnosis: Measuring and Mitigating Narrative Anchoring in Clinical Language Models

相同事实,不同诊断:临床语言模型中叙事锚定的测量与缓解

Prabhjot Singh, Pritam Deka, Vijay Chennareddy

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Queen’s University Belfast(贝尔法斯特女王大学) Middlesex University London(伦敦密德萨斯大学)

专题命中 诊断辅助 :diagnosis(title)

AI总结 本研究针对临床语言模型的叙事锚定偏差,构建含1000个USMLE案例的基准,提出NarrativeShield三智能体流水线,可大幅降低叙事锚定差距并减少不稳定决策,同时发布数据集供相关研究使用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23524 2026-07-28 cs.AI 新提交 71%

Delegation Intelligence in Deep Search: A Controllable Framework for Disentangled Capability Diagnosis

深度搜索中的委托智能:一种用于解缠能力诊断的可控框架

Xinhao Yao, Yuanzhuo Liu, Changhao Wang, Yunfei Yu, Haoran Tan, Yuyao Zhang, Ruifeng Ren, Minlong Peng, Yong Liu

机构 * UCAS(中国科学院大学) Renmin University of China(中国人民大学)

专题命中 诊断辅助 :diagnosis(title)

AI总结 研究深度搜索中委托智能,将其分解为搜索决策和信息合成与验证维度。通过开发可控合成管道构建DelegSearchBench及评估协议,实验证明仅用最终答案准确性不能充分表征深度搜索能力。

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13708 2026-07-16 astro-ph.SR 新提交 71%

Multi-height Diagnosis of MHD Wave Periods and their Propagation in Solar Plages Using IRIS Observations

利用IRIS观测对太阳谱斑中磁流体动力学(MHD)波周期及其传播的多高度诊断

Gayathri Hegde, Pradeep Kayshap

专题命中 诊断辅助 :diagnosis(title)

AI总结 该研究利用IRIS光谱观测,对太阳谱斑五个高度的MHD波进行研究,发现谱斑内主导周期不变,孔隙中线性下降;确定了不同高度截止周期;还得出谱线在孔隙、谱斑和宁静太阳中形成高度的变化情况。

Comments 26 Pages, 16 figures, Accepted for Publication in Advances in Space Research Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05966 2026-07-08 cs.RO 新提交 71%

Imagined Rollouts are Kinematic, Not Dynamic: A Diagnosis of Long-Horizon World-Model Failure

想象的展开是运动学的,而非动力学的:对长期世界模型失败的诊断

Finn Rasmus Schäfer, Korbinian Moller, Yuan Gao, Christian Oefinger, Sebastian Schmidt, Johannes Betz

机构 * Autonomous Vehicle Systems Lab(自动驾驶车辆系统实验室) Technical University of Munich(慕尼黑技术大学) Data Analytics and Machine Learning Group(数据分析与机器学习小组)

专题命中 诊断辅助 :diagnosis(title)

AI总结 研究针对世界模型长期失败问题,提出用运动学与动力学重新构建的方法,通过想象的运动学一致性误差(iKCE)及扰动协议进行诊断,在DreamerV3检查点实例化,区分了运动学与动力学想象,揭示模型长期失败特征。

Comments 9 Pages Workshop Paper accepted at RSS Robot World Model Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18239 2026-06-23 cs.RO 新提交 71%

EBench: Elemental Diagnosis of Generalist Mobile Manipulation Policies

EBench: 通用移动操作策略的要素诊断

Ning Gao, Jinliang Zheng, Xing Gao, Haoxiang Ma, Hanqing Wang, Yukai Wang, Jiantong Chen, Zanxin Chen, Shujie Zhang, Mingda Jia, Xuekun Jiang, Zihou Zhu, Xinyu Li, Shuai Wang, Hao Li, Wenzhe Cai, Yuqiang Yang, Xudong Xu, Zhaoyang Lyu, Yao Mu, Tai Wang, Jiangmiao Pang, Jia Zeng, Weinan Zhang, Chunhua Shen

机构 * Shanghai AI Laboratory(上海人工智能实验室) Xi’an Jiaotong University(西安交通大学) Institute for AI Industry Research (AIR), Tsinghua University(清华大学智能产业研究院) Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学)

专题命中 诊断辅助 :diagnosis(title)

AI总结 提出EBench基准,从5个能力和4个泛化维度诊断通用移动操作模型,揭示不同模型在成功率相近时能力差异显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17519 2026-06-17 cs.CL cs.AI 新提交 71%

Scaling Enterprise Agent Routing: Degradation, Diagnosis, and Recovery

扩展企业智能体路由:退化、诊断与恢复

Kellen Gillespie, Robyn Perry

机构 * Superhuman, Inc.(Superhuman公司)

专题命中 诊断辅助 :diagnosis(title)

AI总结 研究企业助手工具库扩展时路由准确率下降问题,通过嵌入预选恢复F1分数10-17个百分点。

Comments 10 pages (6 main + 4 appendix), 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15325 2026-06-16 cs.CL 新提交 71%

Prior over Evidence: Stereotype-Driven Diagnosis in LLM-Based L2 Pronunciation Feedback

先验优于证据:基于LLM的二语发音反馈中的刻板印象驱动诊断

Rong Wang, Kun Sun

机构 * University of Tuebingen(蒂宾根大学) Tongji University(同济大学)

专题命中 诊断辅助 :diagnosis(title)

AI总结 研究测试了LLM在二语发音反馈中是否基于语音证据而非预训练先验进行诊断,发现评分准确性与推理脱钩,音素级反馈收敛于固定困难音素集,且声学证据仅在直接探测目标维度时改善评分。

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20087 2026-07-23 cs.CV 新提交 70%

Development of an automated, reliable, and clinically meaningful artificial intelligence (AI) tool for diagnosing cardiac disease from conventional cardiovascular magnetic resonance (CMR) images

开发一种用于从传统心血管磁共振(CMR)图像中诊断心脏病的自动化、可靠且具有临床意义的人工智能(AI)工具

Sina Amirrajab, Volker Vehof, Michael Bietenbeck, Nuriye Akyol, Redouane Bouras, Khuraman Isgandarova, Alexandru Zlibut, Philipp Stalling, Ali Yilmaz

专题命中 诊断辅助 :pathology(abstract);diagnosis(abstract);分类 cs.CV

AI总结 研究旨在开发用于CMR图像心脏病诊断的AI工具,通过整合开源LLMs和预处理多模态数据,对三种视觉基础模型两阶段微调,在独立测试集上有高诊断性能,集成策略进一步提升准确性和鲁棒性,代码和模型权重公开。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27678 2026-06-29 cs.CV 新提交 70%

Two-Stage Cross-Domain Cervical Abnormality Screening with Cytopathological Image Synthesis and Knowledge Distillation

两阶段跨域宫颈异常筛查:细胞病理图像合成与知识蒸馏

Jincheng Li, Yuzhi He, Yihui Zhan, Xinmei Zhang, Yifei Sun, Zelin Liu, Lichi Zhang, Minye Shao, Lili Zhao

机构 * School of Artificial Intelligence and Computer Science, Nantong University(南通大学人工智能与计算机科学学院) School of Telecommunications Engineering, Xidian University(西安电子科技大学通信工程学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) School of Biomedical Engineering, Shanghai Jiao Tong University(上海交通大学生物医学工程学院) Department of Computer Science, Durham University(杜伦大学计算机科学系)

专题命中 诊断辅助 :pathology(abstract);diagnosis(abstract);分类 cs.CV

AI总结 提出两阶段框架,先用SC-UNSB合成中间域缓解域偏移,再用知识蒸馏对齐特征,提升跨域宫颈细胞检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25933 2026-07-29 cs.CL cs.AI 新提交 67%

Evaluating Multi-Turn Multimodal Diagnostic Reasoning on Challenging Real-World Clinical Cases

评估具有挑战性的真实世界临床病例中的多轮多模态诊断推理

Rui Yang, Weihao Xuan, Yi Lin, Zhuhan Bao, Jonathan Chong Kai Liew, Matthew Yu Heng Wong, Nicolás Lescano, Nikita R. Paripati, Emily Ling-Lin Pai, Jiarui Liu, Heli Qi, Heng-Jui Chang, Benny Kai Guo Loo, Huitao Li, Kunyu Yu, Yufan Wang, Chuan Hong, Shijian Lu, Douglas Teodoro, Naoto Yokoya, Ross Koppel, Mona Diab, Hua Xu, David W. Bates, Nan Liu, Yifan Peng

机构 * Center for Biomedical Data Science, Duke-NUS Medical School(生物医学数据科学中心,杜克 - 新加坡国立大学医学院) Duke-NUS AI + Medical Sciences Initiative, Duke-NUS Medical School(杜克 - 新加坡国立大学人工智能与医学科学计划,杜克 - 新加坡国立大学医学院) Department of Population Health Sciences, Weill Cornell Medicine(人口健康科学系,威尔康奈尔医学院) System Engineering, College of Engineering, Cornell University(系统工程,康奈尔大学工程学院) Graduate School of Frontier Sciences, The University of Tokyo(前沿科学研究生院,东京大学) RIKEN Center for Advanced Intelligence Project(理化学研究所先进智能项目中心) Department of Biostatistics and Bioinformatics, Duke University(生物统计学与生物信息学系,杜克大学) Perelman School of Medicine, University of Pennsylvania(佩雷尔曼医学院,宾夕法尼亚大学) School of Clinical Medicine, University of Cambridge(临床医学学院,剑桥大学) Hospital of the University of Pennsylvania(宾夕法尼亚大学医院) Children’s Hospital of Philadelphia (CHOP)(费城儿童医院) Department of Anatomic Pathology and Laboratory Medicine, Hospital of the University of Pennsylvania(解剖病理学与检验医学系,宾夕法尼亚大学医院) Department of Pathology and Laboratory Medicine, University of California, San Francisco(病理学与检验医学系,加州大学旧金山分校) Language Technologies Institute, Carnegie Mellon University(语言技术研究所,卡内基梅隆大学)

专题命中 诊断辅助 :medical image(abstract);diagnosis(abstract)

AI总结 研究针对现有多模态大语言模型评估难以捕捉现实临床诊断复杂性的问题,开发ClinMM-Bench基准,用两级框架评估15个模型,发现专有模型诊断准确性最高,但各模型完全正确诊断比例有限,当前模型诊断推理有局限并明确了失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12182 2026-07-15 physics.med-ph quant-ph 新提交 67%

Roadmap Towards Quantum Entanglement Positron Emission Tomography (QE-PET)

量子纠缠正电子发射断层扫描(QE-PET)的路线图

Paweł Moskal, Shiva Abbaszadeh, Harmanjeet Singh Bilkhu, Peter Caradonna, Pragya Das, Praveen Gurunath Bharathi, Ana Marija Kožuljević, Zdenka Kuncic, Deepak Kumar, Mihael Makek, Marek Nowakowski, Siddharth Parashari, Kaustav Prasad, Gregory R. Romanchek, Sushil Sharma, Kenji Shimazoe, Ewa Stępień, Sodai Takyu, Miwako Takahashi, Mizuki Uenomachi, Ritesh Verma, Taiga Yamaya

专题命中 诊断辅助 :pathology(abstract);diagnosis(abstract)

AI总结 介绍量子纠缠正电子发射断层扫描(QE-PET)研究现状,阐述利用湮灭光子纠缠的探测器系统及物理现象,通过抑制随机符合等开发相关方法技术,有望用于增强PET成像、确定诊断生物标志物及pH成像,邀科学界加入该新兴领域。

详情

展开后加载摘要…

URL PDF HTML 收藏