arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

2026-08-21 至 2026-08-21 共收录 37 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 病理影像 1 篇

2607.25497 2026-08-21 cs.CV cs.AI 版本更新 79%

A Distributional Robustness Margin For Pathology Foundation Models

超越计数:病理学基础模型的分布稳健性余量

Clément Grisi, Jeroen van der Laak, Geert Litjens

机构 * Radboud University Medical Center(拉德堡德大学医学中心)

专题命中 病理影像 :pathology(title,abstract);分类 cs.CV

AI总结 研究病理学基础模型受非生物学变异影响的问题,提出交叉混杂稳健性余量(CRoMa),通过直接比较距离评估模型稳健性,将其重塑为队列范围的余量分布,为模型选择和稳健性评估提供原则基础。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 医疗多模态 1 篇

2606.15910 2026-08-21 cs.CL 版本更新 67%

Calibrated Triage, Not Autonomy: Confidence Estimation for Medical Vision-Language Models

校准的分诊,而非自主:医学视觉-语言模型的置信度估计

Reza Khanmohammadi, Kundan Thind, Mohammad M. Ghassemi

机构 * Michigan State University(密歇根州立大学)

专题命中 医疗多模态 :pathology(abstract);radiology(abstract)

AI总结 针对医学视觉-语言模型在回答时可能忽略图像而依赖语言先验的问题,提出使用置信度估计进行校准分诊,通过评估七种置信度估计器,发现高置信度区域是区分可用估计器的关键,最佳探针可将错误率从41-45%降至1-4%,但无估计器在所有领域和模型中一致最优。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 生物医学文本 3 篇

2607.19020 2026-08-21 cs.LG cs.AI cs.IR q-bio.QM 版本更新 60%

Drift-Adaptive ICU Intervention Prediction: Freezing the Physiological Encoder for Auditable Model Updating

重症监护室时间序列预测中的生物失忆:一种具有时间检索的漂移自适应双流架构

Fatema Ferdous Tamanna, K. M. Merajul Arefin, Md. Abdul Masud

机构 * Patuakhali Science and Technology University(帕图阿卡利科学技术大学) University of Dhaka(达卡大学)

专题命中 生物医学文本 :clinical AI(abstract);分类 cs.LG、q-bio

AI总结 研究重症监护室时间序列预测中临床决策支持系统退化问题,提出自适应临床智能架构,通过解耦生理与治疗表征、限制参数更新等实现漂移自适应,实验验证其有效性,为高风险临床环境中部署自适应模型提供模板。

Comments v2: narrower scope. The v1 cross-model XGBoost comparison, is not carried forward: it used a fixed threshold across differently calibrated models. Claims are now restricted to within-architecture comparisons (selective vs. full adaptation); retrieval results are exploratory. Title updated. 12 pages, 4 figures, 7 tables. Code: this https URL (https://github.com/empresst/ClinicalRag). Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19201 2026-08-21 cs.CL cs.AI cs.IR q-bio.QM 新提交 54%

Automatic bioinformatic software named entity recognition from literature

从文献中自动识别生物信息学软件命名实体

Hao Xuan, Rithvij Pasupuleti, Ben Liu, Haishuo Sun, Jun Zhang, Zijun Yao, Cuncong Zhong

专题命中 生物医学文本 :biomedical(abstract);分类 q-bio

AI总结 本研究提出混合命名实体识别框架SNAIL,结合词汇与语义建模策略,在基准数据集及真实文献上识别生物信息学软件/数据库,性能优于现有方法,可用于大规模文献的资源元分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05268 2026-08-21 physics.optics 版本更新 50%

Fast 360-Degree 3D Metrology for Directed Energy Deposition

用于定向能量沉积的快速360度三维计量

James Taylor, Jiazhang Wang, Guanzhong Hu, Zihan Chen, Ping Guo, Florian Willomitzer

专题命中 生物医学文本 :biomedical(abstract)

AI总结 针对定向能量沉积(DED)现有三维监测的不足,提出单镜头多视图偏振条纹投影轮廓术(FPP)系统,实现360度快速三维计量,深度精度优于60μm,可用于DED的实时原位层间监测。

Comments 12 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 医学数据与评测 2 篇

2604.02022 2026-08-21 cs.AI 版本更新 78%

ATBench: A Diverse and Realistic Agent Trajectory Benchmark for Safety Evaluation and Diagnosis

ATBench:一个多样且现实的代理轨迹基准,用于安全评估与诊断

Yu Li, Haoyu Luo, Yuejin Xie, Yuqian Fu, Zhonghao Yang, Shuai Shao, Qihan Ren, Wanying Qu, Yanwei Fu, Yujiu Yang, Jing Shao, Xia Hu, Dongrui Liu

机构 * Shanghai AI Lab(上海人工智能实验室) Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) KAUST(卡塔尔人工智能科学中心) East China Normal University(华东师范大学)

专题命中 医学数据与评测 :diagnosis(title,abstract)

AI总结 ATBench通过多样化的轨迹和现实场景评估代理安全,包含1000条轨迹,挑战性强,支持跨基准比较和长周期故障诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15242 2026-08-21 cs.AI cs.SE 版本更新 50%

LongRCA Bench: Diagnosing Responsible Roles and Root Causes in Long-Horizon Agent Failures

LongRCA Bench:诊断长 horizon 智能体失败中的责任角色与根本原因

Yunfei Zhang, Boyu Feng, Changhua Pei, Zexin Wang, Zhihuang Peng, Xinlong Liu, Hengyue Jiang, Difeng Ma, Jiayi Zhang, Yongzhou Yao, Yanan Zhao, Fei Sun, Yintong Huo, Zhaoyang Liu, Jingjing Li, Gaogang Xie, Dan Pei

机构 * Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心) Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院) Chongqing University(重庆大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Singapore Management University(新加坡管理大学) Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) Tsinghua University(清华大学)

专题命中 医学数据与评测 :diagnosis(abstract)

AI总结 LongRCA Bench 是含1140条失败轨迹的长 horizon 智能体失败诊断基准,本文提出无需训练的 RCTA 方法,在责任角色归因和根本步骤定位上优于现有基线,表明需将二者作为独立评估目标。

Comments 18 pages, 6 figures. Yunfei Zhang and Boyu Feng contributed equally. Changhua Pei is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏