arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

2026-04-14 至 2026-04-14 共收录 6 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 医学数据与评测 6 篇

2604.11762 2026-04-14 cs.CV cs.LG eess.SP physics.med-ph stat.ML 82%

MosaicMRI: A Diverse Dataset and Benchmark for Raw Musculoskeletal MRI

MosaicMRI:一个多样化的数据集和基准用于原始骨科MRI

Paula Arguello, Berk Tinaz, Mohammad Shahab Sepehri, Maryam Soltanolkotabi, Mahdi Soltanolkotabi

机构 * University of Southern California(南加州大学) USC Center on AI Foundations for the Sciences(南加州大学科学人工智能基础中心) University of Utah(犹他大学)

专题命中 医学数据与评测 :MRI(title,abstract);分类 cs.CV、cs.LG、eess.SP

AI总结 本文提出MosaicMRI数据集,用于训练和评估机器学习方法,通过多样化解剖结构和成像参数,研究模型在不同场景下的表现,揭示跨解剖相关性的重要性。

Comments 15 pages, 6 figures, preliminary version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11653 2026-04-14 cs.CV 57%

GazeVaLM: A Multi-Observer Eye-Tracking Benchmark for Evaluating Clinical Realism in AI-Generated X-Rays

GazeVaLM:一个多观察者眼动基准测试,用于评估AI生成X光片的临床真实性

David Wong, Zeynep Isik, Bin Wang, Marouane Tliba, Gorkem Durak, Elif Keles, Halil Ertugrul Aktas, Aladine Chetouani, Cagdas Topel, Nicolo Gennaro, Camila Lopes Vendrami, Tugce Agirlar Trabzonlu, Amir Ali Rahsepar, Laetitia Perronne, Matthew Antalek, Onural Ozturk, Gokcan Okur, Andrew C. Gordon, Ayis Pyrros, Frank H. Miller, Amir Borhani, Hatice Savas, Eric Hart, Elizabeth Krupinski, Ulas Bagci

机构 * Northwestern University(西北大学) Loyola University Chicago(洛约拉大学芝加哥分校) DuPage Medical Group(杜佩奇医疗集团) Emory University(埃默里大学)

专题命中 医学数据与评测 :medical image(abstract);分类 cs.CV

AI总结 GazeVaLM通过眼动数据和临床标签,评估AI生成X光片的临床真实性,对比人类专家与LLM的诊断准确性。

Comments This work appears in ACM ETRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10293 2026-04-14 eess.SP 57%

Impact of Validation Strategy on Machine Learning Performance in EEG-Based Alcoholism Classification

验证策略对基于EEG的酒精成瘾分类机器学习性能的影响

Tahir Cetin Akinci, Yuksel Celik, Omer Faruk Ertugrul

专题命中 医学数据与评测 :biomedical(abstract);分类 eess.SP

AI总结 本文研究了验证策略对EEG酒精成瘾分类性能的影响,通过对比不同验证方法发现传统验证方法存在乐观偏差,AdaBoost方法表现最优,具有高准确率和平衡的灵敏度与特异度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09791 2026-04-14 cs.AI cs.CL cs.LG cs.MA 57%

Pioneer Agent: Continual Improvement of Small Language Models in Production

先驱代理:生产环境中小语言模型的持续改进

Dhruv Atreja, Julia White, Nikhil Nayak, Kelton Zhang, Henrijs Princis, George Hurn-Maloney, Ash Lewis, Urchade Zaratiana

机构 * Fastino Labs

专题命中 医学数据与评测 :diagnosis(abstract);分类 cs.LG

AI总结 本文提出Pioneer Agent,通过闭环系统自动化小语言模型的持续改进,通过冷启动和生产模式提升模型性能,发现有效训练策略。

Comments 43 pages, 10 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11094 2026-04-14 cs.SE cs.AI 50%

E2E-REME: Towards End-to-End Microservices Auto-Remediation via Experience-Simulation Reinforcement Fine-Tuning

E2E-REME:通过经验-模拟强化微服务自动修复

Lingzhe Zhang, Yunpeng Zhai, Tong Jia, Minghua He, Chiming Duan, Zhaoyang Liu, Bolin Ding, Ying Li

机构 * Peking University(北京大学) Key Laboratory of Data Intelligence and Security(数据智能与安全重点实验室) Alibaba Group(阿里巴巴集团) Key Laboratory of Data Space Technology and System(数据空间技术与系统重点实验室)

专题命中 医学数据与评测 :diagnosis(abstract)

AI总结 本文提出E2E-MR任务,通过经验-模拟强化训练构建E2E-REME模型,实现从诊断报告自动生成可执行playbook,提升微服务系统修复的准确性和效率。

Comments accepted by FSE'26. arXiv admin note: text overlap with arXiv:2511.01166

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10853 2026-04-14 cs.AI 50%

A Benchmark for Gap and Overlap Analysis as a Test of KG Task Readiness

一个用于空缺和重叠分析的基准:作为知识图谱任务准备性的测试

Maruf Ahmed Mridul, Rohit Kapa, Oshani Seneviratne

机构 * Rensselaer Polytechnic Institute, Troy, New York, United States(伦斯勒理工学院,纽约州特洛伊市,美国) Prudential Financial, Inc.(保德信金融集团)

专题命中 医学数据与评测 :diagnosis(abstract)

AI总结 本文提出一个可执行且可审计的基准,用于评估知识图谱的质量,通过将自然语言合同文本与形式本体对齐,系统比较方法。该基准包括简化但多样的人寿保险合同、领域本体和知识库,以及58个结构化场景和SPARQL查询,展示显式建模提升空缺和重叠分析的一致性和诊断能力。

详情

展开后加载摘要…

URL PDF HTML 收藏