arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

共收录 2124 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 医学数据与评测 2124 篇

2504.08596 2025-10-08 cs.CL cs.AI 50%

MedHal: An Evaluation Dataset for Medical Hallucination Detection

Gaya Mehenni, Fabrice Lamarche, Odette Rios-Ibacache, John Kildea, Amal Zouaq

机构 * LAMA-WeST Lab(LAMA-WeST实验室) Polytechnique Montréal(蒙特利尔理工学院) Mila - Quebec AI Institute(魁北克AI研究院) Medical Physics Unit - RI-MUHC(医学物理部门 - RI-MUHC) McGill University(麦吉尔大学)

专题命中 医学数据与评测 :medical AI(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05003 2025-10-07 cs.CL cs.AI 50%

Resource-Efficient Fine-Tuning of LLaMA-3.2-3B for Medical Chain-of-Thought Reasoning

Imran Mansha

机构 * Department of Information Technology(信息科技系) The Islamia University of Bahawalpur(巴哈瓦尔普尔伊斯兰大学)

专题命中 医学数据与评测 :medical AI(abstract)

Comments 6 pages, 2 figures. Submitted to arXiv for open access

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04671 2025-10-07 cs.CL cs.AI 50%

FocusMed: A Large Language Model-based Framework for Enhancing Medical Question Summarization with Focus Identification

Chao Liu, Ling Luo, Tengxiao Lv, Huan Zhuang, Lejing Yu, Jian Wang, Hongfei Lin

机构 * 1 College of Computer Science Technology, Dalian University of Technology, Dalian, China 2 Cancer Hospital of Dalian University of Technology, Liaoning Cancer Hospital \& Institute, Shenyang, China

专题命中 医学数据与评测 :diagnosis(abstract)

Comments Accepted as a regular paper at BIBM2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04338 2025-10-07 cs.CL 50%

Evaluation of Clinical Trials Reporting Quality using Large Language Models

Mathieu Laï-king, Patrick Paroubek

机构 * Université Paris-Saclay, CNRS, LISN(巴黎-萨克雷大学、法国国家科学研究中心、LISN)

专题命中 医学数据与评测 :biomedical(abstract)

Journal ref Revue TAL 65.2, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26440 2025-10-07 cs.AI 50%

Transformer Classification of Breast Lesions: The BreastDCEDL_AMBL Benchmark Dataset and 0.92 AUC Baseline

Naomi Fridman, Anat Goldstein

机构 * Department of Industrial Engineering, Ariel University(工业工程系,阿丽尔大学)

专题命中 医学数据与评测 :MRI(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00543 2025-10-02 cs.CE 50%

Flow of Knowledge: Federated Fine-Tuning of LLMs in Healthcare under Non-IID Conditions

Zeyu Chen, Yun Ji, Bowen Wang, Liwen Shi, Zijie Zeng, Sheng Zhang

专题命中 医学数据与评测 :medical AI(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00280 2025-10-02 cs.CL 50%

ReEvalMed: Rethinking Medical Report Evaluation by Aligning Metrics with Real-World Clinical Judgment

Ruochen Li, Jun Li, Bailiang Jian, Kun Yuan, Youxiang Zhu

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心) University of Massachusetts Boston(马萨诸塞大学波士顿分校) University of Strasbourg(斯特拉斯堡大学)

专题命中 医学数据与评测 :radiology(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17091 2025-09-30 cs.SD cs.CL 50%

SVeritas: Benchmark for Robust Speaker Verification under Diverse Conditions

Massa Baali, Sarthak Bisht, Francisco Teixeira, Kateryna Shapovalenko, Rita Singh, Bhiksha Raj

专题命中 医学数据与评测 :diagnosis(abstract)

Comments Accepted to EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10171 2025-09-30 cs.CR cs.AI cs.CL 50%

Beyond Jailbreaking: Auditing Contextual Privacy in LLM Agents

Saswat Das, Jameson Sandler, Ferdinando Fioretto

专题命中 医学数据与评测 :clinical AI(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13577 2025-09-29 cs.SD cs.AI eess.AS 50%

VocalAgent: Large Language Models for Vocal Health Diagnostics with Safety-Aware Evaluation

Yubin Kim, Taehan Kim, Wonjune Kang, Eugene Park, Joonsik Yoon, Dongjae Lee, Xin Liu, Daniel McDuff, Hyeonhoon Lee, Cynthia Breazeal, Hae Won Park

机构 * Massachusetts Institute of Technology, USA(麻省理工学院, 美国) Seoul National University Hospital, South Korea(首尔国立大学医院, 韩国) Doctor Diary, South Korea(Doctor Diary, 韩国) Google Research, USA(谷歌研究, 美国) Independent Researcher(独立研究者)

专题命中 医学数据与评测 :diagnosis(abstract)

Comments Accepted by Proceedings of Interspeech 2025; Website: https://han811.github.io/VocalAgent2025/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21188 2025-09-26 cs.HC cs.AI cs.CY cs.IR 50%

Adoption, usability and perceived clinical value of a UK AI clinical reference platform (iatroX): a mixed-methods formative evaluation of real-world usage and a 1,223-respondent user survey

Kolawole Tytler

专题命中 医学数据与评测 :biomedical(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23577 2025-09-24 cs.CL 50%

T-Detect: Tail-Aware Statistical Normalization for Robust Detection of Adversarial Machine-Generated Text

Alva West, Luodan Zhang, Liuliu Zhang, Minjun Zhu, Yixuan Weng, Yue Zhang

机构 * School of Engineering, Westlake University(西拉丘学院,西湖大学)

专题命中 医学数据与评测 :CT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15640 2025-09-23 cs.CL 50%

AfriMed-QA: A Pan-African, Multi-Specialty, Medical Question-Answering Benchmark Dataset

Tobi Olatunji, Charles Nimo, Abraham Owodunni, Tassallah Abdullahi, Emmanuel Ayodele, Mardhiyah Sanni, Chinemelu Aka, Folafunmi Omofoye, Foutse Yuehgoh, Timothy Faniran, Bonaventure F. P. Dossou, Moshood Yekini, Jonas Kemp, Katherine Heller, Jude Chidubem Omeke, Chidi Asuzu MD, Naome A. Etori, Aimérou Ndiaye, Ifeoma Okoh, Evans Doe Ocansey, Wendy Kinara, Michael Best, Irfan Essa, Stephen Edward Moore, Chris Fourie, Mercy Nyamewaa Asiedu

机构 * Intron Georgia Institute of Technology(佐治亚理工学院) The Ohio State University(俄亥俄州立大学) BioRAMP Masakhane Google Research(谷歌研究) Kenyatta University(肯雅塔大学) University of Cape Coast(科克大学) SisonkeBiotik MILA Quebec(MILA魁北克) University of Minnesota(明尼苏达大学) Brown University(布朗大学) McGill University(麦吉尔大学)

专题命中 医学数据与评测 :biomedical(abstract)

Comments ACL 2025 Main Conference (long paper, Best Social Impact Paper Award)

Journal ref Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pages 1948-1973, Vienna, Austria. Association for Computational Linguistics, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12465 2025-09-17 quant-ph 50%

Efficient Privacy-Preserving Training of Quantum Neural Networks by Using Mixed States to Represent Input Data Ensembles

Gaoyuan Wang, Jonathan Warrell, Mark Gerstein

专题命中 医学数据与评测 :biomedical(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10584 2025-09-16 cs.CY cs.AI cs.CL 50%

Smart Trial: Evaluating the Use of Large Language Models for Recruiting Clinical Trial Participants via Social Media

Xiaofan Zhou, Zisu Wang, Janice Krieger, Mohan Zalake, Lu Cheng

机构 * University of Illinois at Chicago(伊利诺伊大学香槟分校) Colorado State University(科罗拉多州立大学)

专题命中 医学数据与评测 :CT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16661 2025-09-10 cs.CL 50%

A Japanese Language Model and Three New Evaluation Benchmarks for Pharmaceutical NLP

Shinnosuke Ono, Issey Sukeda, Takuro Fujii, Kosei Buma, Shunsuke Sasaki

机构 * EQUES Inc.(EQUES公司) The University of Tokyo(东京大学) University of Tsukuba(筑波大学)

专题命中 医学数据与评测 :biomedical(abstract)

Comments 15 pages, 9 tables, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03194 2025-09-04 stat.ME stat.AP 50%

Bayesian Network Propensity Score to Evaluate Treatment Effects in Observational Studies

Clelia Di Serio, Federica Cugnata, Pier Luigi Conti, Alberto Briganti, Fulvia Mecatti, Paola Vicard, Paola Maria Vittoria Rancoita

专题命中 医学数据与评测 :biomedical(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02915 2025-09-04 cs.CL 50%

English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM

Taekyung Ahn, Hosung Nam

机构 * Enuma, Inc.(Enuma公司) Korea University(韩国大学)

专题命中 医学数据与评测 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00728 2025-09-03 cs.IR cs.DB 50%

A Survey on Open Dataset Search in the LLM Era: Retrospectives and Perspectives

Pengyue Li, Sheng Wang, Hua Dai, Zhiyu Chen, Zhifeng Bao, Brian D. Davison

专题命中 医学数据与评测 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20014 2025-08-28 cs.MA 50%

CataractSurg-80K: Knowledge-Driven Benchmarking for Structured Reasoning in Ophthalmic Surgery Planning

Yang Meng, Zewen Pan, Yandi Lu, Ruobing Huang, Yanfeng Liao, Jiarui Yang

专题命中 医学数据与评测 :medical AI(abstract)

Comments 18 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16475 2025-08-25 physics.med-ph 50%

Transcranial Photoacoustic Imaging for Human Intracranial Pressure Evaluation

Ruixi Sun, Hengrong Lan, Yuanyuan Dang, Yunhui Jiang, Youshen Xiao, Sheng Liao, Fan Zhang, Daohuai Jiang, Zhongqi Li, Hulin Zhao, Fei Gao

专题命中 医学数据与评测 :diagnosis(abstract)

Comments Co-first authors: Ruixi Sun, Hengrong Lan, Yuanyuan Dang. Corresponding authors: Zhongqi Li (jasonlee0091@outlook.com), Hulin Zhao (zhaohulin_90@sohu.com), Fei Gao (fgao@ustc.edu.cn)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15192 2025-08-22 cs.AI cs.CL 50%

LLM4Sweat: A Trustworthy Large Language Model for Hyperhidrosis Support

Wenjie Lin, Jin Wei-Kocsis

专题命中 医学数据与评测 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14710 2025-08-21 cs.AI 50%

Data-Driven Probabilistic Evaluation of Logic Properties with PAC-Confidence on Mealy Machines

Swantje Plambeck, Ali Salamati, Eyke Huellermeier, Goerschwin Fey

机构 * Hamburg University of Technology(汉堡工业大学) Ludwig-Maximilians-Universität München(慕尼黑路德维希-马克西米利安大学)

专题命中 医学数据与评测 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13790 2025-08-21 cs.AI 50%

The NordDRG AI Benchmark for Large Language Models

Tapio Pitkäranta

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Aalto University(阿alto大学)

专题命中 医学数据与评测 :diagnosis(abstract)

Comments 23 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05083 2025-08-08 cs.AI 50%

MedMKEB: A Comprehensive Knowledge Editing Benchmark for Medical Multimodal Large Language Models

Dexuan Xu, Jieyi Wang, Zhongyan Chai, Yongzhi Cao, Hanpin Wang, Huamin Zhang, Yu Huang

专题命中 医学数据与评测 :medical AI(abstract)

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12106 2025-08-08 cs.CL cs.AI 50%

Can open source large language models be used for tumor documentation in Germany? -- An evaluation on urological doctors' notes

Stefan Lenz, Arsenij Ustjanzew, Marco Jeray, Meike Ressing, Torsten Panholzer

专题命中 医学数据与评测 :diagnosis(abstract)

Comments 53 pages, 5 figures

Journal ref BioData Mining volume 18, Article number 48 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19407 2025-08-07 cs.CL 50%

Towards Domain Specification of Embedding Models in Medicine

Mohammad Khodadad, Ali Shiraee Kasmaee, Mahdi Astaraki, Hamidreza Mahyar

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) McMaster University(麦斯特大学)

专题命中 医学数据与评测 :biomedical(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12342 2025-08-07 cs.CL 50%

CRAB: A Benchmark for Evaluating Curation of Retrieval-Augmented LLMs in Biomedicine

Hanmeng Zhong, Linqing Chen, Wentao Wu, Weilei Wang

机构 * PatSnap Co., LTD.(PatSnap公司)

专题命中 医学数据与评测 :biomedical(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02490 2025-08-05 cs.AI 50%

PHM-Bench: A Domain-Specific Benchmarking Framework for Systematic Evaluation of Large Models in Prognostics and Health Management

Puyu Yang, Laifa Tao, Zijian Huang, Haifei Liu, Wenyan Cao, Hao Ji, Jianan Qiu, Qixuan Huang, Xuanyuan Su, Yuhang Xie, Jun Zhang, Shangyu Li, Chen Lu, Zhixuan Lian

专题命中 医学数据与评测 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14425 2025-08-04 physics.ins-det 50%

Evaluation of a Full Field Fluorescence Imager with Synchrotron Radiation

Piotr Maj, Grzegorz W. Deptuch, Dominik S. Gorni, Giovanni Pinaroli, Gabriella A. Carini, David P. Siddons, Ryan Tappero, Soumyajit Mandal, Donald Pinelli, Timothy Kersten, Nicholas St. John, Abdul K. Rumaiz, Anthony Kuczewski

专题命中 医学数据与评测 :biomedical(abstract)

Comments Preprint submitted to Journal of Synchrotron Radiation

详情

展开后加载摘要…

URL PDF HTML 收藏