arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

共收录 2119 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 医学数据与评测 2119 篇

2601.16753 2026-01-26 cs.CL cs.AI 78%

Standardizing Longitudinal Radiology Report Evaluation via Large Language Model Annotation

通过大型语言模型标注标准化纵向放射学报告评估

Xinyi Wang, Grazziela Figueredo, Ruizhe Li, Xin Chen

专题命中 医学数据与评测 :radiology(title,abstract)

AI总结 本文提出基于大型语言模型的标注方法,用于标准化放射学报告中的纵向信息评估,通过对比实验验证了其在疾病进展检测和跟踪方面的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11020 2026-01-26 cs.CR cs.AI 78%

Data Poisoning Vulnerabilities Across Healthcare AI Architectures: A Security Threat Analysis

医疗AI架构中的数据中毒漏洞:安全威胁分析

Farhad Abtahi, Fernando Seoane, Iván Pau, Mario Vega-Barbas

专题命中 医学数据与评测 :healthcare AI(title,abstract)

AI总结 医疗AI面临数据中毒威胁,需多层防御措施和可解释系统以提高安全性。

Journal ref J Med Internet Res 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13268 2026-01-21 cs.AI 78%

Improving the Safety and Trustworthiness of Medical AI via Multi-Agent Evaluation Loops

通过多智能体评估循环提升医疗AI的安全性与可信度

Zainab Ghafoor, Md Shafiqul Islam, Koushik Howlader, Md Rasel Khondokar, Tanusree Bhattacharjee, Sayantan Chakraborty, Adrito Roy, Ushashi Bhattacharjee, Tirtho Roy

机构 * Sonoma State University(索诺玛州立大学) Iowa State University(爱荷华州立大学) University of Dhaka(达卡大学) Notre Dame College(诺特丹学院)

专题命中 医学数据与评测 :medical AI(title,abstract)

AI总结 本文提出多智能体评估循环框架,通过结合DeepSeek R1和Med-PaLM等模型,有效提升医疗AI的安全性和伦理合规性,实现89%的伦理违规减少和92%的风险降级。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12632 2026-01-21 cs.CL cs.IR 78%

BioPulse-QA: A Dynamic Biomedical Question-Answering Benchmark for Evaluating Factuality, Robustness, and Bias in Large Language Models

BioPulse-QA: 一个动态生物医学问答基准,用于评估大型语言模型的事实性、鲁棒性和偏见

Kriti Bhattarai, Vipina K. Keloth, Donald Wright, Andrew Loza, Yang Ren, Hua Xu

专题命中 医学数据与评测 :biomedical(title,abstract)

AI总结 BioPulse-QA是一个动态生物医学问答基准,用于评估大型语言模型在事实性、鲁棒性和偏见方面的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16530 2025-12-19 cs.CL cs.AI 78%

Plain language adaptations of biomedical text using LLMs: Comparision of evaluation metrics

利用大语言模型对生物医学文本进行plain language改编:评估指标的比较

Primoz Kocbek, Leon Kopitar, Gregor Stiglic

专题命中 医学数据与评测 :biomedical(title,abstract)

AI总结 本研究比较了利用大语言模型对生物医学文本进行plain language改编的不同方法,发现gpt-4o-mini在评估指标上表现优异,而微调方法效果欠佳。

Comments 5 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13702 2025-12-17 cs.CY cs.AI 78%

Enhancing Transparency and Traceability in Healthcare AI: The AI Product Passport

提升医疗AI的透明度与可追溯性:AI产品护照

A. Anil Sinaci, Senan Postaci, Dogukan Cavdaroglu, Machteld J. Boonstra, Okan Mercan, Kerem Yilmaz, Gokce B. Laleci Erturkmen, Folkert W. Asselbergs, Karim Lekadir

专题命中 医学数据与评测 :healthcare AI(title,abstract)

AI总结 本研究提出AI产品护照,通过生命周期文档提升医疗AI的透明度和可追溯性,符合FUTURE-AI原则,确保公平性和可用性,并通过开源平台实现可访问性。

Comments A total of 33 pages: First 16 pages for the manuscript and the remaining 17 pages for the supplementary user guide of the graphical user interface

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08185 2025-12-10 cs.CR cs.AI 78%

A Practical Framework for Evaluating Medical AI Security: Reproducible Assessment of Jailbreaking and Privacy Vulnerabilities Across Clinical Specialties

评估医疗AI安全的实用框架:在不同临床专科中可重复评估劫持和隐私漏洞

Jinghao Wang, Ping Zhang, Carter Yagemann

机构 * The Ohio State University(俄亥俄州立大学)

专题命中 医学数据与评测 :medical AI(title,abstract)

AI总结 本文提出了一种可重复评估医疗AI安全性的框架,针对不同临床专科的劫持和隐私漏洞进行评估,无需特殊资源或数据权限。

Comments 6 pages, 1 figure, framework proposal

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03340 2025-12-04 cs.CL 78%

PERCS: Persona-Guided Controllable Biomedical Summarization Dataset

PERCS:基于人物的可控生物医学摘要数据集

Rohan Charudatt Salvi, Chirag Chawla, Dhruv Jain, Swapnil Panigrahi, Md Shad Akhtar, Shweta Yadav

机构 * Department of Computer Science, University of Illinois, Chicago, IL, 60607, USA(伊利诺伊大学芝加哥分校计算机科学系) Indian Institute of Technology, Varanasi, India(印度班加罗尔理工学院) Department of Computer Science & Engineering, Indraprastha Institute of Information Technology, Delhi, New Delhi, 110020, India(印度德里印度信息技术研究所计算机科学与工程系)

专题命中 医学数据与评测 :biomedical(title,abstract)

AI总结 PERCS数据集通过针对不同医学素养角色的可控摘要,提升生物医学信息的可及性与准确性。

Comments 9 pages, 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18556 2025-10-22 cs.CL 78%

Building Trust in Clinical LLMs: Bias Analysis and Dataset Transparency

Svetlana Maslenkova, Clement Christophe, Marco AF Pimentel, Tathagata Raha, Muhammad Umar Salman, Ahmed Al Mahrooqi, Avani Gupta, Shadab Khan, Ronnie Rajan, Praveenkumar Kanithi

机构 * M42, Abu Dhabi(阿布扎比M42)

专题命中 医学数据与评测 :clinical LLM(title);clinical AI(abstract)

Comments Accepted to EMNLP Main 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16765 2025-10-09 cs.CL cs.AI cs.SD eess.AS 78%

The Sound of Syntax: Finetuning and Comprehensive Evaluation of Language Models for Speech Pathology

Fagun Patel, Duc Q. Nguyen, Sang T. Truong, Jody Vaynshtok, Sanmi Koyejo, Nick Haber

机构 * Stanford University(斯坦福大学) National University of Singapore(新加坡国立大学) Sound Speech and Hearing Clinic(语音与听力诊所)

专题命中 医学数据与评测 :pathology(title,abstract)

Comments EMNLP 2025 Oral Presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03700 2025-10-07 cs.AI 78%

H-DDx: A Hierarchical Evaluation Framework for Differential Diagnosis

Seungseop Lim, Gibaeg Kim, Hyunkyung Lee, Wooseok Han, Jean Seo, Jaehyo Yoo, Eunho Yang

机构 * AITRICS KAIST(韩国科学技术院)

专题命中 医学数据与评测 :diagnosis(title,abstract)

Comments GenAI4Health @NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14479 2025-09-19 cs.SD 78%

A long-form single-speaker real-time MRI speech dataset and benchmark

Sean Foley, Jihwan Lee, Kevin Huang, Xuan Shi, Yoonjeong Lee, Louis Goldstein, Shrikanth Narayanan

机构 * Signal Analysis and Interpretation Lab, University of Southern California(南加州大学信号分析与解释实验室) Department of Linguistics, University of Southern California(南加州大学语言学系)

专题命中 医学数据与评测 :MRI(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15464 2025-08-22 cs.CL cs.AI 78%

RadReason: Radiology Report Evaluation Metric with Reasons and Sub-Scores

Yingshu Li, Yunyi Liu, Lingqiao Liu, Lei Wang, Luping Zhou

机构 * School of Electrical and Computer Engineering, University of Sydney(悉尼大学电气与计算机工程学院) School of Computer Science, University of Adelaide(阿德莱德大学计算机科学学院) School of Computing and Information Technology, University of Wollongong(沃林根大学计算与信息科技学院)

专题命中 医学数据与评测 :radiology(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05347 2025-08-06 cs.CL cs.MA 78%

GEMA-Score: Granular Explainable Multi-Agent Scoring Framework for Radiology Report Evaluation

Zhenxuan Zhang, Kinhei Lee, Peiyuan Jing, Weihang Deng, Huichi Zhou, Zihao Jin, Jiahao Huang, Zhifan Gao, Dominic C Marshall, Yingying Fang, Guang Yang

专题命中 医学数据与评测 :radiology(title);diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14045 2025-07-21 cs.CL 78%

Evaluating the Effectiveness of Cost-Efficient Large Language Models in Benchmark Biomedical Tasks

Israt Jahan, Md Tahmid Rahman Laskar, Chun Peng, Jimmy Huang

专题命中 医学数据与评测 :biomedical(title,abstract)

Comments Accepted at Canadian AI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13651 2025-07-21 cs.AI 78%

Buggy rule diagnosis for combined steps through final answer evaluation in stepwise tasks

Gerben van der Hoek, Johan Jeuring, Rogier Bos

专题命中 医学数据与评测 :diagnosis(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11578 2025-04-17 physics.med-ph 78%

A Comparative Evaluation of CT Global Noise Calculation Methods for Clinical Image Quality Assessment

Charles M Weaver, Gary Ge, Alexander Alsalihi, Jie Zhang

专题命中 医学数据与评测 :CT(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09587 2025-03-13 eess.IV cs.CV cs.LG 78%

Fair Federated Medical Image Classification Against Quality Shift via Inter-Client Progressive State Matching

Nannan Wu, Zhuo Kuang, Zengqiang Yan, Ping Wang, Li Yu

专题命中 医学数据与评测 :medical image(title);分类 cs.CV、cs.LG、eess.IV

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17301 2025-02-14 cs.CL cs.AI 78%

ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation

Yunyi Liu, Yingshu Li, Zhanyu Wang, Xinyu Liang, Lingqiao Liu, Lei Wang, Luping Zhou

专题命中 医学数据与评测 :radiology(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13458 2024-10-18 cs.CL 78%

MedINST: Meta Dataset of Biomedical Instructions

Wenhan Han, Meng Fang, Zihan Zhang, Yu Yin, Zirui Song, Ling Chen, Mykola Pechenizkiy, Qingyu Chen

专题命中 医学数据与评测 :biomedical(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09632 2024-10-15 cs.CL 78%

SciGisPy: a Novel Metric for Biomedical Text Simplification via Gist Inference Score

Chen Lyu, Gabriele Pergola

专题命中 医学数据与评测 :biomedical(title,abstract)

Comments Accepted by he Third Workshop on Text Simplification, Accessibility and Readability

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13317 2024-09-23 cs.CL 78%

JMedBench: A Benchmark for Evaluating Japanese Biomedical Large Language Models

Junfeng Jiang, Jiahao Huang, Akiko Aizawa

专题命中 医学数据与评测 :biomedical(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03560 2024-06-07 physics.med-ph 78%

Anatomy-based quality metric of diffusion-weighted MRI data for accurate derivation of muscle fiber orientation

Nadya Shusharina, Xiaofeng Liu, Evangelia Kaza, Miranda Lam, Stephan Maier, Jonghye Woo

专题命中 医学数据与评测 :MRI(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04963 2024-04-09 cs.CL cs.AI 78%

SemEval-2024 Task 2: Safe Biomedical Natural Language Inference for Clinical Trials

Mael Jullien, Marco Valentino, André Freitas

专题命中 医学数据与评测 :biomedical(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.04270 2024-02-21 cs.CL cs.AI 78%

A Comprehensive Evaluation of Large Language Models on Benchmark Biomedical Text Processing Tasks

Israt Jahan, Md Tahmid Rahman Laskar, Chun Peng, Jimmy Huang

专题命中 医学数据与评测 :biomedical(title,abstract)

Comments Accepted to the Computers in Biology and Medicine journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.16578 2024-02-20 cs.CL cs.AI 78%

Leveraging Professional Radiologists' Expertise to Enhance LLMs' Evaluation for Radiology Reports

Qingqing Zhu, Xiuying Chen, Qiao Jin, Benjamin Hou, Tejas Sudharshan Mathai, Pritam Mukherjee, Xin Gao, Ronald M Summers, Zhiyong Lu

专题命中 医学数据与评测 :radiology(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.09461 2023-12-20 cs.AI cs.CR 78%

Advancing COVID-19 Diagnosis with Privacy-Preserving Collaboration in Artificial Intelligence

Xiang Bai, Hanchen Wang, Liya Ma, Yongchao Xu, Jiefeng Gan, Ziwei Fan, Fan Yang, Ke Ma, Jiehua Yang, Song Bai, Chang Shu, Xinyu Zou, Renhao Huang, Changzheng Zhang, Xiaowu Liu, Dandan Tu, Chuou Xu, Wenqing Zhang, Xi Wang, Anguo Chen, Yu Zeng, Dehua Yang, Ming-Wei Wang, Nagaraj Holalkere, Neil J. Halin, Ihab R. Kamel, Jia Wu, Xuehua Peng, Xiang Wang, Jianbo Shao, Pattanasak Mongkolwat, Jianjun Zhang, Weiyang Liu, Michael Roberts, Zhongzhao Teng, Lucian Beer, Lorena Escudero Sanchez, Evis Sala, Daniel Rubin, Adrian Weller, Joan Lasenby, Chuangsheng Zheng, Jianming Wang, Zhen Li, Carola-Bibiane Schönlieb, Tian Xia

专题命中 医学数据与评测 :diagnosis(title);CT(abstract)

Comments Nature Machine Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08701 2023-12-15 cs.DC 78%

Enabling End-to-End Secure Federated Learning in Biomedical Research on Heterogeneous Computing Environments with APPFLx

Trung-Hieu Hoang, Jordan Fuhrman, Ravi Madduri, Miao Li, Pranshu Chaturvedi, Zilinghan Li, Kibaek Kim, Minseok Ryu, Ryan Chard, E. A. Huerta, Maryellen Giger

专题命中 医学数据与评测 :biomedical(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16764 2023-11-29 cs.CL 78%

Radiology-Aware Model-Based Evaluation Metric for Report Generation

Amos Calamida, Farhad Nooralahzadeh, Morteza Rohanian, Koji Fujimoto, Mizuho Nishio, Michael Krauthammer

专题命中 医学数据与评测 :radiology(title,abstract)

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.11254 2023-11-14 cs.CL 78%

An In-Depth Evaluation of Federated Learning on Biomedical Natural Language Processing

Le Peng, Gaoxiang Luo, sicheng zhou, jiandong chen, Rui Zhang, Ziyue Xu, Ju Sun

专题命中 医学数据与评测 :biomedical(title,abstract)

Comments Accepted by KDD 2023 Workshop FL4Data-Mining

详情

展开后加载摘要…

URL PDF HTML 收藏