arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

2026-06-16 至 2026-06-16 共收录 99 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 诊断辅助 17 篇

2606.15278 2026-06-16 cs.LG cs.AI 新提交 57%

RECTOR: Masked Region-Channel-Temporal Modeling for Affective and Cognitive Representation Learning

RECTOR:面向情感与认知表征学习的掩码区域-通道-时间建模

Jinhan Liu, Mahsa Shoaran

机构 * Cornell University(康奈尔大学)

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 提出RECTOR自监督框架,通过自适应功能分区和掩码拓扑学习,统一建模EEG/sEEG的区域-通道-时间动态,在情感识别和任务参与分类上达到新最优,且对缺失通道和跨导联泛化鲁棒。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00163 2026-06-16 cs.LG cs.AI cs.NE 版本更新 57%

Epileptic Seizure Detection in Separate Frequency Bands Using Feature Analysis and Graph Convolutional Neural Network (GCN) from Electroencephalogram (EEG) Signals

基于特征分析和图卷积神经网络(GCN)的脑电图(EEG)信号癫痫发作检测在不同频段的研究

Ferdaus Anam Jibon, Fazlul Hasan Siddiqui, F. Deeba, Gahangir Hossain

专题命中 诊断辅助 :diagnosis(abstract);分类 cs.LG

AI总结 提出一种频率感知框架,将EEG分解为五个频段并提取判别特征,利用图卷积神经网络建模电极空间依赖,在CHB-MIT数据集上实现99.01%的宽带准确率,提高了可解释性和诊断精度。

Comments One author disagrees with the archiving

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16710 2026-06-16 cs.MA cs.CL 新提交 50%

Misinformation Propagation in Benign Multi-Agent Systems

良性多智能体系统中的错误信息传播

Jonas Becker, Jan Philip Wahle, Terry Ruas, Bela Gipp

机构 * University of Göttingen, Germany(德国哥廷根大学) LKA NRW, Germany(德国北莱茵-威斯特法伦州警署) Shared last authorship(共同通讯作者)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 研究在良性多智能体系统中,基于意图的错误信息如何通过智能体交互传播,并发现多智能体辩论相比单智能体提示能减少性能下降,鲁棒性取决于群体组成和决策协议。

Comments 20 pages, 8 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16617 2026-06-16 cs.CL cond-mat.mtrl-sci cs.AI 新提交 50%

Sycophancy as Material Failure under Pushback Loading: A Multi-Axis Characterization Across Three Loading Cases and up to Seventeen Material Charges

推挤载荷下的谄媚作为材料失效:三种加载情形及多达十七种材料批次的多元表征

Ferdinand M. Schessl

机构 * typx.org

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 采用材料科学框架,将LLM谄媚视为推挤载荷下的材料失效,通过14个轴测量和三种加载情形(辩论、错误预设、伦理设定)共7800个样本,揭示失效模式依赖加载类型,并发现跨评判者可靠性差异。

Comments 12 pages, 3 figures. Code, data, and pre-registrations: https://github.com/FerdinandSchessl/sycophancy-note-companion

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15140 2026-06-16 physics.flu-dyn 新提交 50%

Vorticity-dynamical analysis of Richtmyer-Meshkov instability based on orbital-spin vorticity decomposition

基于轨道-自旋涡量分解的Richtmyer-Meshkov不稳定性涡量动力学分析

Xi Chen, Tao Chen, Tianshu Liu

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 提出轨道-自旋涡量分解方法,分析激波驱动Richtmyer-Meshkov不稳定性中的涡量动力学,揭示传统涡量范式无法捕捉的涡流物理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15081 2026-06-16 physics.soc-ph physics.pop-ph 新提交 50%

Toward a Geopolitical Crisis Observatory: Diagnosing Systemic Risk in News Flows Using Complex Systems Science

迈向地缘政治危机观测站:利用复杂系统科学诊断新闻流中的系统性风险

Didier Sornette

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 提出利用复杂系统科学框架,通过检测相关性变化、放大、持续性和内生性等结构前兆,诊断新闻流中的系统性风险,构建地缘政治危机观测站,将媒体从被动报道转向主动诊断。

Comments 9 pages, Published 11 June 2026, Al Jazeera Centre for Studies, https://studies.aljazeera.net/en/reports

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13909 2026-06-16 cs.GT cs.AI 版本更新 50%

TERMS-Bench: Diagnosing LLM Negotiation Agents Beyond Deal Rate

TERMS-Bench: 在交易率之外评估大语言模型谈判代理

Erica Zhang, Fangzhao Zhang, Aneesh Pappu, Batu El, Jose Blanchet, Susan Athey, Jiashuo Liu, James Zou

机构 * Stanford School of Engineering(斯坦福大学工程学院) Stanford Department of Economics(斯坦福大学经济系) Stanford Graduate School of Business(斯坦福商学院)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 TERMS-Bench通过博弈论框架评估谈判代理,揭示其在交易率之外的性能差异,如盈余提取、线索使用和合规性。

Comments Project Site: https://terms-bench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09370 2026-06-16 cs.DC cs.AI 版本更新 50%

From Detection to Recovery: Operational Analysis on LLM Pre-training with 504 GPUs

从检测到恢复:504 GPU上LLM预训练的运营分析

Daemyung Kang, Eunjin Hwang, Hanjeong Lee, HyeokJin Kim, Hyunhoi Koo, Jeongkyu Shin, Jeongseok Kang, Jihyun Kang, Jinho Heo, Joongi Kim, Junbum Lee, Jungseung Yang, Kyujin Cho, Youngsook Song

机构 * Lablup Inc.(Lablup公司)

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 本文通过分析一个63节点NVIDIA B200生产集群(504 GPU)55天的Prometheus时间序列数据和73天的运营日志,提出了三项定量分析,揭示了多信号检测策略、存储I/O瓶颈和自动重试恢复机制的有效性。

Comments 42 pages, 19 figures, 16 tables. Lablup Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16629 2026-06-16 gr-qc hep-ph hep-th math-ph math.MP 版本更新 50%

Universal geometric framework for black hole phase transitions: from multivaluedness to classification

黑洞相变的统一几何框架:从多值性到分类

Shi-Hao Zhang, Zi-Yuan Li, Jing-Fei Zhang, Xin Zhang

专题命中 诊断辅助 :diagnosis(abstract)

AI总结 通过构建结合实分析与覆盖空间理论的几何框架,揭示了黑洞一级相变中热力学、动力学和几何量同步多值行为的普遍数学机制,并基于温度曲线的极值点提出黑洞分类方案。

Comments 20 pages, 2 figures

Journal ref Eur. Phys. J. C 86, 642 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 病理影像 10 篇

2606.16026 2026-06-16 cs.CL 新提交 82%

In-Domain Supervised Pathology Report Classification: A Reproducible Pipeline from Data Curation to Production-Matched Evaluation

领域内监督病理报告分类:从数据整理到生产匹配评估的可复现流程

Isaac Hands, Bin Huang, Adam Spannaus, John Gounley, Heidi Hanson, Eric Durbin, Sally R. Ellingson

机构 * University of Kentucky(肯塔基大学) UK Markey Cancer Center(肯塔基大学马基癌症中心) Kentucky Cancer Registry(肯塔基癌症登记处) Division of Cancer Biostatistics, University of Kentucky(肯塔基大学癌症生物统计学系) Oak Ridge National Laboratory(橡树岭国家实验室) Division of Biomedical Informatics, University of Kentucky(肯塔基大学生物医学信息学系)

专题命中 病理影像 :pathology(title,abstract);biomedical(abstract)

AI总结 提出领域内监督流程解决病理报告跨注册中心性能下降问题,通过标准化数据整理、生产匹配保留集和低假阴性率操作点选择,在418k报告集上FNR降至0.003,F1提升至0.922。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02877 2026-06-16 cs.CV 版本更新 79%

Pathway-Structured Privileged Distillation for Deployable Computational Pathology

面向可部署计算病理学的通路结构特权蒸馏

Yongxin Guo, Hao Lu, Onur Koyun, Muhammet Demir, Metin Gurcan

机构 * School of Medicine, Wake Forest University(威克森林大学医学院)

专题命中 病理影像 :pathology(title,abstract);分类 cs.CV

AI总结 提出MoPE框架,通过通路索引病理专家和记忆使用对齐,将多模态学习转化为仅组织学推理的特权蒸馏,提升全切片图像推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09755 2026-06-16 cs.AI 75%

Explainability Through Human-Centric Design for XAI in Lung Cancer Detection

通过以人为中心的设计实现XAI在肺癌检测中的可解释性

Amy Rafferty, Rishi Ramaesh, Ajitha Rajan

机构 * University of Edinburgh(爱丁堡大学) NHS Lothian(NHS洛锡安)

专题命中 病理影像 :pathology(abstract);diagnosis(abstract);radiology(abstract)

AI总结 本文提出XpertXAI模型,通过人类中心设计在肺癌检测中实现可解释性,优于现有方法,提供更符合专家推理的概念解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19444 2026-06-16 cs.LG cs.CV 73%

Leveraging Expert Input for Robust and Explainable AI-Assisted Lung Cancer Detection in Chest X-rays

利用专家输入实现稳健且可解释的AI辅助肺癌检测

Amy Rafferty, Rishi Ramaesh, Ajitha Rajan

机构 * School of Informatics, University of Edinburgh(信息学院,爱丁堡大学) NHS Lothian(洛锡安国家健康服务)

专题命中 病理影像 :medical image(abstract);diagnosis(abstract);分类 cs.CV、cs.LG

AI总结 本文研究了基于InceptionV3的肺癌检测模型的可解释性和鲁棒性,提出ClinicXAI方法,通过专家驱动的思路生成临床相关解释,并在对抗攻击下表现出更强的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17179 2026-06-16 cs.MA 版本更新 67%

Ablation Study of a Fairness Auditing Agentic System for Bias Mitigation in Early-Onset Colorectal Cancer Detection

公平性审计代理系统在早发性结直肠癌检测中缓解偏见的消融研究

Amalia Ionescu, Jose Guadalupe Hernandez, Jui-Hsuan Chang, Emily F. Wong, Paul Wang, Jason H. Moore, Tiffani J. Bright

专题命中 病理影像 :clinical AI(abstract);biomedical(abstract)

AI总结 提出双代理架构(领域专家代理+公平性顾问代理),通过消融实验比较不同配置下大语言模型在公平性审计中的表现,发现带RAG的代理系统在识别差异方面语义相似度最高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16658 2026-06-16 cs.CV 新提交 57%

Vision-Language Models as Zero-Annotation Oracles in Histopathology

视觉-语言模型作为组织病理学中的零标注预言机

Vishal Jain, Giorgio Buzzanca, Sarah Cechnicka, Maarten Naesens, Priyanka Koshy, Tri Nguyen, Jesper Kers, Candice Roufosse, Bernhard Kainz

机构 * Imperial College London(帝国理工学院) Leiden University Medical Center(莱顿大学医学中心) KU Leuven(鲁汶大学) University Hospitals Leuven(鲁汶大学医院) University Medical Center Utrecht(乌得勒支大学医学中心) Friedrich-Alexander University Erlangen-Nürnberg(埃尔朗根-纽伦堡大学)

专题命中 病理影像 :pathology(abstract);分类 cs.CV

AI总结 提出一种粗到细方法,利用通用视觉-语言模型作为零标注预言机进行前景分割,在特殊染色上优于监督基线,并通过伪标签蒸馏轻量学生模型。

Comments 11 pages, 1 figure, 6 tables. Code available at https://github.com/VishalJ99/vlm-wsi-auto-context

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16515 2026-06-16 cs.LG cs.AI cs.RO 新提交 57%

Direction-Conditioned Policies via Compositional Subgoal Scoring for Online Goal-Conditioned Reinforcement Learning

基于组合子目标评分的方向条件策略用于在线目标条件强化学习

Swaminathan S K, Damiya Gondha, Theyanesh Eswaramoorthy Rajahkrishnan, Aritra Hazra

机构 * Department of Computer Science and Engineering, Indian Institute of Technology Kharagpur(计算机科学与工程系,印度理工学院Kharagpur分校) Department of Mechanical Engineering, Indian Institute of Technology Kharagpur(机械工程系,印度理工学院Kharagpur分校)

专题命中 病理影像 :pathology(abstract);分类 cs.LG

AI总结 提出方向条件策略(DCP),通过共享InfoNCE表示将目标达成分解为子目标评分和方向条件动作,理论证明方向充分性、训练与部署一致性及可控子空间失效条件,在九个环境中优于对比RL。

Comments 17 pages, Accepted to the 2nd Workshop on Compositional Learning at ICML 2026 (Seoul, South Korea)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15784 2026-06-16 cs.LG cs.CE 新提交 57%

Bayesian Networks with Latent Time Embedding for Stage-Aware Causal Modeling of Alzheimer's Disease Progression

具有潜在时间嵌入的贝叶斯网络用于阿尔茨海默病进展的阶段感知因果建模

Nguyen Linh Dan Le

机构 * Alzheimer's Disease Neuroimaging Initiative(阿尔茨海默病神经影像学倡议) Open Access Series of Imaging Studies(开放获取影像学研究系列)

专题命中 病理影像 :pathology(abstract);分类 cs.LG

AI总结 提出BN-LTE框架,结合贝叶斯网络与潜在时间嵌入,利用AT(N)级联约束建模AD进展,在ADNI数据上优于基线,并识别出淀粉样蛋白敏感性的中期伪时间窗口。

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15019 2026-06-16 cs.CV 新提交 57%

Towards Global AI-Driven Cervical Cancer Screening

迈向全球人工智能驱动的宫颈癌筛查

Thuy Nuong Tran, Ömer Sümer, Evangelia Christodoulou, Lennart Nauschütte, Simon Kalteis, Martin Paulikat, Esmira Pashayeva, Klara Steinheuer, Isabella Borges, Piotr Kalinowski, Hermann Bussmann, Sieng Sokmney, Poeung Kuong, Sathiarany Vong, Achim Schneider, Magnus von Knebel-Doeberitz, Patrick Godau, Lena Maier-Hein

机构 * German Cancer Research Center (DKFZ)(德国癌症研究中心) Heidelberg University(海德堡大学) National Center for Tumor Diseases (NCT) Heidelberg(海德堡国家肿瘤疾病中心) Helmholtz Association(亥姆霍兹联合会) University of Heidelberg(海德堡大学) Medical Faculty Heidelberg(海德堡医学院) University Hospital Heidelberg(海德堡大学医院) German Consortium for Translational Cancer Research (DKTK)(德国转化癌症研究联盟) National Center for Tumor Diseases (NCT) Dresden(德累斯顿国家肿瘤疾病中心) University Hospital Carl Gustav Carus Dresden(德累斯顿卡尔·古斯塔夫·卡鲁斯大学医院) Technische Universität Dresden(德累斯顿工业大学) Helmholtz-Zentrum Dresden-Rossendorf (HZDR)(亥姆霍兹德累斯顿罗森多夫研究中心) University of Bonn(波恩大学) University Hospital Bonn(波恩大学医院) University of Cologne(科隆大学) University Hospital Cologne(科隆大学医院) University of Duisburg-Essen(杜伊斯堡-埃森大学) University Hospital Essen(埃森大学医院) University of Freiburg(弗莱堡大学) University Hospital Freiburg(弗莱堡大学医院) University of Göttingen(哥廷根大学) University Hospital Göttingen(哥廷根大学医院) University of Hamburg(汉堡大学) University Hospital Hamburg-Eppendorf(汉堡-埃彭多夫大学医院) University of Jena(耶拿大学) University Hospital Jena(耶拿大学医院) University of Kiel(基尔大学) University Hospital Schleswig-Holstein(石勒苏益格-荷尔斯泰因大学医院) University of Leipzig(莱比锡大学) University Hospital Leipzig(莱比锡大学医院) University of Lübeck(吕贝克大学) University Hospital Lübeck(吕贝克大学医院) University of Magdeburg(马格德堡大学) University Hospital Magdeburg(马格德堡大学医院) University of Mainz(美因茨大学) University Hospital Mainz(美因茨大学医院) University of Marburg(马尔堡大学) University Hospital Marburg(马尔堡大学医院) University of Munich (LMU)(慕尼黑大学) University Hospital Munich (LMU)(慕尼黑大学医院) Technical University of Munich (TUM)(慕尼黑工业大学) University Hospital rechts der Isar (TUM)(慕尼黑工业大学伊萨尔河右岸医院) University of Münster(明斯特大学) University Hospital Münster(明斯特大学医院) University of Regensburg(雷根斯堡大学) University Hospital Regensburg(雷根斯堡大学医院) University of Rostock(罗斯托克大学) University Hospital Rostock(罗斯托克大学医院) University of Tübingen(蒂宾根大学) University Hospital Tübingen(蒂宾根大学医院) University of Ulm(乌尔姆大学) University Hospital Ulm(乌尔姆大学医院) University of Würzburg(维尔茨堡大学) University Hospital Würzburg(维尔茨堡大学医院)

专题命中 病理影像 :pathology(abstract);分类 cs.CV

AI总结 提出首个基于深度学习、在多国数据上验证的宫颈癌筛查方法,通过多任务学习同时进行图像分类和病变分割,在内部验证中优于医生,但外部验证显示性能因国家而异。

Comments 20 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15563 2026-06-16 cs.AI cs.IT cs.MA math.IT 新提交 50%

Minimal Oversight: Uncertainty-Aware Governance for Delegated AI Systems

最小监督:委托AI系统的不确定性感知治理

Carlos R. B. Azevedo

机构 * Independent Researcher(独立研究员)

专题命中 病理影像 :pathology(abstract)

AI总结 提出最小充分监督原则(MSO),通过Fisher信息流形上的变分法最小化治理负担,导出任务空间的水填充分配,并证明容量定理、局部近似和漂移主导的自律时间标度律,为委托AI系统提供可计算的治理框架。

Comments Companion Python package: pip install minimal-oversight | Code: https://github.com/crbazevedo/delegation-lab | 26 pages, 1 figure, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 医疗多模态 1 篇

2606.16573 2026-06-16 cs.CV 新提交 70%

Transformation-driven generation of comparable projection images from multimodal anatomical scenes

从多模态解剖场景生成可比较投影图像的变换驱动方法

Dariusz Pojda, Krzysztof Domino, Michał Tarnawski, Agnieszka Anna Tomaka

机构 * Institute of Theoretical and Applied Informatics, Polish Academy of Sciences(波兰科学院理论与应用信息学研究所)

专题命中 医疗多模态 :CT(abstract,abstract_cn);分类 cs.CV

AI总结 提出变换驱动框架,从多模态解剖数据生成可重复的投影空间观测,通过下颌运动场景验证,实现不同解剖配置下直接可比的虚拟X光投影生成。

Comments 36 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 生物医学文本 9 篇

2606.16211 2026-06-16 cs.CL 新提交 78%

Weaving Multi-Source Evidence for Biomedical Reasoning: The BioMedHop Benchmark and BioWeave Framework

编织多源证据进行生物医学推理:BioMedHop基准与BioWeave框架

Xingyu Tan, Shiyuan Liu, Xiaoyang Wang, Qing Liu, Xiwei Xu, Xin Yuan, Liming Zhu, Wenjie Zhang

机构 * University of New South Wales(新南威尔士大学) CSIRO(澳大利亚联邦科学与工业研究组织) University of Technology Sydney(悉尼科技大学)

专题命中 生物医学文本 :biomedical(title,abstract)

AI总结 提出BioMedHop基准和BioWeave框架,用于评估和实现生物医学多源证据推理,BioWeave在基准上优于基线方法10.5%,并提升小模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09500 2026-06-16 cs.AI cs.DL 版本更新 71%

Deterministic Integrity Gates for LLM-Assisted Clinical Manuscript Preparation: An Auditable Biomedical Informatics Architecture

用于LLM辅助临床手稿准备的确定性完整性门控:一种可审计的生物医学信息学架构

Yoojin Nam, Jinhoon Jeong, Namkug Kim

机构 * University of Ulsan College of Medicine(蔚山大学医学院) Asan Medical Center(峨山医疗中心) Aperivue AMIST, Asan Medical Center(AMIST,峨山医疗中心)

专题命中 生物医学文本 :biomedical(title)

AI总结 提出一种确定性完整性门控架构,通过将工作流分解为可独立验证的技能并在每个阶段设置确定性检查,解决了LLM生成临床手稿中的虚假引用、数据漂移和报告指南缺失问题。

Comments 28 pages, 3 figures, 4 tables; includes supplementary material (deterministic-detector inventory, per-class defect breakdown, worked example). Software (MIT): https://github.com/Aperivue/medsci-skills . Archived on Zenodo: concept DOI https://doi.org/10.5281/zenodo.20155321 and version DOI (v3.8.0) https://doi.org/10.5281/zenodo.20582972

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15155 2026-06-16 cs.LG 新提交 70%

Semantic Reasoning in Medicine: The Role of Knowledge Graphs Across Five Key Domains

医学中的语义推理:知识图谱在五个关键领域的作用

Haniye Sherafatmandjoo, Mohammad Akbari, Zahed Rahmati

机构 * Amirkabir University of Technology(阿米尔卡比尔理工大学)

专题命中 生物医学文本 :medical AI(abstract);biomedical(abstract);分类 cs.LG

AI总结 综述知识图谱在医学中的应用,涵盖临床决策支持、疾病预测、健康推荐、精准医疗和医学问答,并讨论构建方法、挑战及未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15419 2026-06-16 cs.CL cs.AI 新提交 67%

Let LLMs Judge Each Other: Multi-Agent Peer-Reviewed Reasoning for Medical Question Answering

让LLMs互相评判:面向医学问答的多智能体同行评审推理

Zaifu Zhan, Shuang Zhou, Rui Zhang

机构 * University of Minnesota(明尼苏达大学)

专题命中 生物医学文本 :medical AI(abstract);biomedical(abstract)

AI总结 提出多智能体同行评审推理方法,让多个LLM独立生成思维链推理并相互评估,选择最优推理链输出答案,在三个医学问答数据集上优于单模型和多数投票方法。

Comments Accepted by the Journal of the American Medical Informatics Association

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12635 2026-06-16 cs.SE cs.AI cs.LG 57%

LLM4SCREENLIT: Recommendations on Assessing the Performance of Large Language Models for Screening Literature in Systematic Reviews

LLM4SCREENLIT: 关于评估用于系统综述文献筛选的大型语言模型性能的建议

Lech Madeyski, Barbara Kitchenham, Martin Shepperd

机构 * University of Kent(肯特大学) University of Leicester(利兹大学) University of Birmingham(伯明翰大学)

专题命中 生物医学文本 :biomedical(abstract);分类 cs.LG

AI总结 本文提出LLM4SCREENLIT建议,针对系统综述文献筛选中大型语言模型的评估,提出基于加权马修相关系数的改进方法,强调在不平衡和成本不对称条件下使用成本敏感的WMCC进行评估。

Comments 34 pages, 6 figures

Journal ref Information and Software Technology 198 (2026) 108204

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11682 2026-06-16 cs.AI cs.LG 版本更新 57%

MedAI: Evaluating TxAgent's Therapeutic Agentic Reasoning in the NeurIPS CURE-Bench Competition

MedAI: 评估 TxAgent 在 NeurIPS CURE-Bench 竞赛中的治疗性智能推理

Tim Cofala, Christian Kalfar, Jingge Xiao, Johanna Schrader, Michelle Tang, Wolfgang Nejdl

机构 * L3S Research Center(L3S研究中心)

专题命中 生物医学文本 :biomedical(abstract);分类 cs.LG

AI总结 本文介绍 TxAgent,一种通过迭代检索增强生成和统一生物医学工具集进行治疗决策的智能AI方法,并在CURE-Bench竞赛中评估其推理质量,通过改进工具检索策略提升性能,荣获开放科学卓越奖。

Comments 7 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15931 2026-06-16 cs.MA cs.AI 新提交 50%

DeepRoot: A KG-Coordinated Multi-Agent System for Therapeutic Reasoning over Historical Medical Texts

DeepRoot: 一个基于知识图谱协调的多智能体系统,用于历史医学文本的治疗推理

Zijian Carl Ma, Sean J. Wang, Sijbren Kramer, Li Erran Li

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学) University of Cambridge(剑桥大学) University of Toronto(多伦多大学)

专题命中 生物医学文本 :biomedical(abstract)

AI总结 提出DeepRoot多智能体系统,通过联合构建和利用验证知识图谱,将接地与推理分离并组合,从历史医学文本中恢复药物-疾病治疗关系,显著优于基线LLM和工具调用LLM。

Journal ref ICML 2026 GenBio; ACM CAIS 2026 Workshop AI Agents for Discovery in the Wild

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15478 2026-06-16 stat.ME 新提交 50%

A Bayesian Functional Accelerated Failure-Time Model with Varying Effects Correcting for Measurement Error

贝叶斯函数加速失效时间模型:考虑测量误差的变效应

Joseph Yang, Roger Zoh, Carmen Tekwe, Lan Xue

专题命中 生物医学文本 :biomedical(abstract)

AI总结 提出贝叶斯函数加速失效时间模型,通过高斯过程单指标结构建模功能系数随时间和标量协变量的变化,并利用工具变量处理功能协变量的测量误差,以分析可穿戴设备数据中步数活动与缺血性卒中死亡时间的关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.13183 2026-06-16 cs.CY 版本更新 50%

Precision Medicine for the Population-The Hope and Hype of Public Health Genomics

人群的精准医学——公共卫生基因组学的希望与炒作

JunBo Wu, Nathaniel Comfort

专题命中 生物医学文本 :biomedical(abstract)

AI总结 本文批判“精准公共卫生”过度强调基因组数据对健康结果的决定作用,通过对比进步时代(1890-1920)的类似尝试,指出基因型驱动的预防性公共卫生可能对弱势群体造成伤害,并建议优先整合从分子到社会多层次的数据以避免风险。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 健康监测 2 篇

2606.08583 2026-06-16 cs.LG eess.SP 新提交 62%

A spectral audit framework reveals task-dependent aperiodic reliance across EEG and ECG deep learning

频谱审计框架揭示EEG和ECG深度学习中任务依赖的非周期性依赖

Jasmeet Singh Bindra, Siddharth Panwar

机构 * Indian Knowledge Systems and Mental Health Applications (IKSMHA) Center, Indian Institute of Technology Mandi(印度理工学院曼迪分校印度知识体系与心理健康应用中心) School of Computing and Electrical Engineering, Indian Institute of Technology Mandi(印度理工学院曼迪分校计算与电气工程学院)

专题命中 健康监测 :pathology(abstract);分类 cs.LG、eess.SP

AI总结 提出频谱审计框架,结合非周期/周期分解、相位保持傅里叶干预等,发现深度学习模型对非周期成分的依赖是任务依赖且架构通用的,在睡眠-觉醒分类中影响显著,临床异常检测中中等,运动想象中最小,并扩展到ECG。

Comments 25 pages, being prepared for submission to peer-reviewed journal

详情

展开后加载摘要…

URL PDF HTML 收藏