arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

2026-06-24 至 2026-06-24 共收录 7 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 医学数据与评测 7 篇

2605.09768 2026-06-24 cs.MA 78%

SAGE: Scalable Agentic Grounded Evaluation for Crop Disease Diagnosis

SAGE: 可扩展的代理基于地面评估用于作物疾病诊断

Muhammad Arbab Arshad, Tirtho Roy, Yanben Shen, Dinakaran Elango, Shivani Chiranjeevi, Asheesh K. Singh, Baskar Ganapathysubramanian, Chinmay Hegde, Arti Singh, Soumik Sarkar

专题命中 医学数据与评测 :diagnosis(title,abstract)

AI总结 本文提出SAGE框架,通过构建大规模作物疾病图像-症状数据集,结合自动管道生成基于源的症状描述,并引入自主视觉推理代理提升疾病诊断准确性。

Journal ref CVPR 2026 Workshop on Emerging Directions in Data for Multimodal Foundation Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24302 2026-06-24 cs.CV cs.DL 新提交 70%

TrOCR for Medieval HTR: A Systematic Ablation Study with Cross-Dataset Validation

TrOCR 用于中世纪手写文本识别:基于跨数据集验证的系统消融研究

Sachin Sharma, Michele Flammini, Federico Simonetta

机构 * GSSI – Gran Sasso Science Institute(格兰萨索科学研究所)

专题命中 医学数据与评测 :CT(abstract,abstract_cn);分类 cs.CV

AI总结 研究通过对比度归一化、数据增强和层冻结三种可控微调策略,提升TrOCR在中世纪手稿上的识别精度,在13世纪意大利手稿上达到8.03%字符错误率,并验证了跨数据集的鲁棒性。

Comments Accepted at Document Analysis Systems Workshop 2026 (ICDAR Satellite event)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24145 2026-06-24 cs.AI 新提交 67%

T2D-Bench: Evidence-Gated Evaluation of LLM Outputs for Type 2 Diabetes Using a Multi-Layer Clinical-Lifestyle Knowledge Graph

T2D-Bench:基于多层临床-生活方式知识图谱的2型糖尿病LLM输出证据门控评估

Saba A. Farahani, Hung Cao, Ramesh Jain, Amir M. Rahmani

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 医学数据与评测 :diagnosis(abstract);biomedical(abstract)

AI总结 提出T2D-Bench基准,通过多层知识图谱和证据门控机制,检测LLM输出中未满足指南约束的临床遗漏,并在2型糖尿病诊断、用药安全等场景中实现可测量纠正。

Comments 7 pages, 2 figures, 2 tables. Accepted as a poster at AMIA 2026 Annual Symposium

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24115 2026-06-24 cs.CV cs.AI 新提交 61%

A Benchmark for Hallucination Detection in VLMs for Gastrointestinal Endoscopy

胃肠内窥镜中视觉语言模型幻觉检测的基准测试

Aminu Lawal, Niyoj Oli, Sachin Acharya, Prashnna Gyawali, Maria Carmen Romano, Binod Bhattarai

机构 * University of Aberdeen(阿伯丁大学) Nepal Applied Mathematics and Informatics Institute for Research(尼泊尔应用数学与信息学研究所) West Virginia University(西弗吉尼亚大学)

专题命中 医学数据与评测 :radiology(abstract);分类 cs.CV;medical image(comments)

AI总结 针对胃肠内窥镜领域,在Gut-VLM数据集上基准测试九种幻觉检测方法,发现白盒方法ReXTrust在所有五个视觉语言模型上AUC最高,平均领先19.5点。

Comments Accepted at the Medical Image Understanding and Analysis (MIUA) 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23744 2026-06-24 q-bio.QM cs.CV 新提交 60%

Performance and Interpretability of Convolutional, Transformer, and Hybrid Deep Learning Models in Colorectal Histology Classification

卷积、Transformer和混合深度学习模型在结直肠组织学分类中的性能与可解释性

Reza Bozorgpour

机构 * College of Engineering & Applied Science, Department of Biomedical Engineering, University of Wisconsin-Milwaukee(工程与应用科学学院生物医学工程系,威斯康星大学密尔沃基分校)

专题命中 医学数据与评测 :pathology(abstract);分类 cs.CV、q-bio

AI总结 本研究系统比较了12种预训练CNN、Transformer和混合架构在结直肠组织病理学分类中的性能,发现EVA-02和ViT-B/16表现最佳,而现代CNN在准确率与模型复杂度间取得良好平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24672 2026-06-24 cs.AI 新提交 50%

Cost-Optimal Decision Diagrams for Stochastic Boolean Function Evaluation

随机布尔函数评估的代价最优决策图

Xia Zong, Tuomo Lehtonen, Jussi Rintanen

机构 * Aalto University(阿尔托大学)

专题命中 医学数据与评测 :diagnosis(abstract)

AI总结 针对变量代价和概率分布下的命题公式评估,提出首个实用的精确分支定界算法,含变量选择启发式、剪枝和缓存,并证明问题为#P-hard且属于PSPACE。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24200 2026-06-24 cs.CL cs.AI cs.IR 新提交 50%

MMed-Bench-IR: A Heterogeneous Benchmark for Multilingual Medical Information Retrieval

MMed-Bench-IR:多语言医学信息检索的异构基准

Junhyeok Lee, Han Jang, Hyeonjin Goh, Kyu Sung Choi

机构 * Seoul National University(首尔国立大学) Seoul National University College of Medicine(首尔国立大学医学院) Seoul National University Hospital(首尔国立大学医院)

专题命中 医学数据与评测 :biomedical(abstract)

AI总结 针对临床RAG的多语言检索需求,提出MMed-Bench-IR基准,涵盖跨语言对齐、概念区分和证据检索三种异构任务,评估6种语言下10个系统,发现生物医学编码器在英语与日语间性能差距巨大。

Comments Under review. 15 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏