arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

共收录 966 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 医疗多模态 966 篇

2403.16501 2026-03-26 cs.AI 50%

Learning To Guide Human Decision Makers With Vision-Language Models

通过视觉-语言模型引导人类决策者

Debodeep Banerjee, Stefano Teso, Burcu Sayin, Andrea Passerini

机构 * DI, University of Pisa(比萨大学DI) DISI, University of Trento(特伦托大学DISI) CIMEC, University of Trento(特伦托大学CIMEC) Rajib Pal Bankura Sammilani Medical College(拉吉布·帕尔班克尔医学学院)

专题命中 医疗多模态 :diagnosis(abstract)

AI总结 本文提出LTG框架,通过视觉-语言模型生成可解释的决策指导,使人类负责最终决策,提升高风险场景下的决策质量与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10065 2026-03-24 cs.AI 50%

RadHiera: Semantic Hierarchical Reinforcement Learning for Medical Report Generation

RadHiera:面向医学报告生成的语义分层强化学习

Bodong Du, Honglong Yang, Xiaomeng Li

机构 * The Hong Kong University of Science(香港科技大学)

专题命中 医疗多模态 :radiology(abstract)

AI总结 本文提出RadHiera框架,通过分层强化学习提升医学报告生成的语义一致性与诊断准确性,实验表明其在胸部X光和超声报告生成中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21032 2026-03-24 stat.AP stat.ME 50%

Integrative Predictor-Dependent Learning of Network Data and Spatially Correlated Nodal Attributes for Multimodal Brain Imaging in Aging

整合预测依赖学习网络数据与空间相关节点属性以研究衰老的多模态脑成像

Jose Rodriguez-Acosta, Sharmistha Guha, Jessica Bernard, Thamires Magalhaes, Kaitlin McOwen

专题命中 医疗多模态 :MRI(abstract)

AI总结 本文提出一个预测依赖的联合建模框架,用于多受试者共享节点的网络数据,结合空间坐标和空间相关节点属性,通过整合结构性和功能性信息,研究脑连接模式与衰老相关预测变量的关系。

Comments 38 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12224 2026-03-24 cs.RO cs.AI 50%

RoboFAC: A Comprehensive Framework for Robotic Failure Analysis and Correction

RoboFAC:机器人故障分析与纠正的综合框架

Zewei Ye, Weifeng Lu, Minghao Ye, Tao Lin, Shuo Yang, Junchi Yan, Bo Zhao

机构 * School of AI, Shanghai Jiao Tong University(上海交通大学人工智能学院) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

专题命中 医疗多模态 :diagnosis(abstract)

AI总结 RoboFAC通过构建大规模故障中心数据集,开发轻量级多模态模型,提升机器人故障诊断与纠正能力,实验显示其故障分析准确率比GPT-4o高34.1%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05591 2026-03-19 cs.AI 50%

MLlm-DR: Towards Explainable Depression Recognition with MultiModal Large Language Models

MLlm-DR: 向多模态大语言模型的可解释性抑郁识别迈进

Wei Zhang, Juan Chen, En Zhu, Wenhong Cheng, YunPeng Li, Yanbo J. Wang

机构 * National University of Defense Technology(国防科技大学) University of Chinese Academy of Sciences(中国科学院大学) Shanghai Mental Health Center, Shanghai Jiao Tong University School of Medicine(上海精神卫生中心,上海交通大学医学院) Nanjing Industria Tenebris Information Technology Co., Ltd.(南京Industria Tenebris信息技术有限公司) National University of Uzbekistan named after Mirzo Ulugbek(乌兹别克斯坦Mirzo Ulugbek命名的国立大学)

专题命中 医疗多模态 :diagnosis(abstract)

AI总结 本文提出MLlm-DR模型,通过多模态大语言模型实现可解释的抑郁识别,结合小型LLM和轻量级查询模块,提升诊断性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18453 2026-03-03 cs.AI cs.CL 50%

Reason Like a Radiologist: Chain-of-Thought and Reinforcement Learning for Verifiable Report Generation

像放射科医生一样推理:用于可验证报告生成的推理链和强化学习

Peiyuan Jing, Kinhei Lee, Zhenxuan Zhang, Huichi Zhou, Zhengqing Yuan, Zhifan Gao, Lei Zhu, Giorgos Papanastasiou, Yingying Fang, Guang Yang

专题命中 医疗多模态 :radiology(abstract)

AI总结 BoxMed-RL通过推理链和强化学习生成可验证的放射科报告,提升报告的准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19346 2026-02-24 cs.RO cs.SY eess.SY 50%

Design and Control of Modular Magnetic Millirobots for Multimodal Locomotion and Shape Reconfiguration

模块化磁性微机器人多模态运动与形状重构设计与控制

Erik Garcia Oyono, Jialin Lin, Dandan Zhang

机构 * Department of Bioengineering, Imperial College London(帝国理工学院生物工程系)

专题命中 医疗多模态 :biomedical(abstract)

AI总结 本研究提出一种模块化磁性微机器人平台,通过多模块协同实现多模态运动与形状重构,展示了在受限环境中稳健控制的潜力。

Comments Accepted by 2026 ICRA

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14518 2026-02-17 cs.AI 50%

Diagnosing Knowledge Conflict in Multimodal Long-Chain Reasoning

多模态长链推理中的知识冲突诊断

Jing Tang, Kun Wang, Haolang Lu, Hongjin Chen, KaiTao Chen, Zhongxiang Sun, Qiankun Li, Lingjuan Lyu, Guoshun Nan, Zhigang Zeng

机构 * Huazhong University of Science and Technology(华中科技大学) Nanyang Technological University(南洋理工大学) Beijing University of Posts and Telecommunications(北京邮电大学) Renmin University of China(中国人民大学)

专题命中 医疗多模态 :diagnosis(abstract)

AI总结 本研究提出了一种统一的知识冲突概念,揭示了多模态长链推理中不同冲突类型的特征和处理机制,为诊断和控制推理失败提供了原理性方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00120 2026-02-06 stat.ME stat.ML 50%

AdapDISCOM: An Adaptive Sparse Regression Method for High-Dimensional Multimodal Data With Block-Wise Missingness and Measurement Errors

AdapDISCOM:一种用于高维多模态数据的自适应稀疏回归方法,具有块状缺失和测量误差

Maimouna Baldé, Abdoul O. Diakité, Claudia Moreau, Gleb Bezgin, Nikhil Bhagwat, Pedro Rosa-Neto, Jean-Baptiste Poline, Simon Girard, Amadou Barry

专题命中 医疗多模态 :biomedical(abstract)

AI总结 AdapDISCOM通过自适应稀疏回归方法,有效应对高维多模态数据中的块状缺失和测量误差问题,提升预测性能和生物标志物选择的可靠性。

Comments 49 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07213 2026-02-03 cs.AI 50%

Brain-inspired Computing Based on Deep Learning for Human-computer Interaction: A Review

基于深度学习的脑启发计算用于人机交互:综述

Bihui Yu, Sibo Zhang, Lili Zhou, Jingxuan Wei, Linzhuang Sun, Liping Bu

机构 * Shenyang Institute of Computing Technology, Chinese Academy of Sciences(中国科学院沈阳计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Heilongjiang Academy of Sciences Intelligent Manufacturing Institute(黑龙江科学院智能制造研究所)

专题命中 医疗多模态 :biomedical(abstract)

AI总结 本文综述了基于深度学习的脑启发计算在人机交互中的应用,探讨了其发展、挑战及未来研究方向。

Comments 26pages, 8 figures and 4 tables

Journal ref Neurocomputing, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06364 2026-01-13 cs.HC cs.AI 50%

Human-in-the-Loop Interactive Report Generation for Chronic Disease Adherence

具有临床医生的交互式报告生成用于慢性病依从性

Xiaotian Zhang, Jinhong Yu, Pengwei Yan, Le Jiang, Xingyi Shen, Mumo Cheng, Xiaozhong Liu

专题命中 医疗多模态 :clinical AI(abstract)

AI总结 本文提出一种具有临床医生的交互式报告生成系统,通过AI生成与医生审查的分工,提高慢性病依从性报告的效率和准确性,同时确保问责制。

Comments 5 pages, 3 figures. Accepted at the AAAI 2026 Workshop on AI for Healthy Aging and Longevity

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02611 2026-01-07 physics.bio-ph 50%

Holotomography in 2025: From Morphometric Imaging to AI-Driven Multimodal Phenotyping

2025年的全息成像:从形态学成像到AI驱动的多模态表型分析

YongKeun Park

专题命中 医疗多模态 :pathology(abstract)

AI总结 2025年,全息成像从 niche 技术发展为多功能生物医学成像平台,结合深度学习和多模态技术,推动数字病理学和高通量筛选的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01363 2026-01-06 cs.AI 50%

A unified multimodal understanding and generation model for cross-disciplinary scientific research

面向跨学科科学研究的统一多模态理解和生成模型

Xiaomeng Yang, Zhiyu Tan, Xiaohui Zhong, Mengping Yang, Qiusheng Huang, Lei Chen, Libo Wu, Hao Li

专题命中 医疗多模态 :biomedical(abstract)

AI总结 FuXi-Uni是一种统一多模态模型,能跨学科领域理解和生成科学数据,通过自然语言和科学数值预测提升跨学科研究效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19317 2025-12-23 cs.AI 50%

SafeMed-R1: Adversarial Reinforcement Learning for Generalizable and Robust Medical Reasoning in Vision-Language Models

SafeMed-R1: 为视觉-语言模型中的通用性和鲁棒性医疗推理设计的对抗强化学习

A. A. Gde Yogi Pramana, Jason Ray, Anthony Jaya, Michael Wijaya

机构 * National University of Singapore(新加坡国立大学)

专题命中 医疗多模态 :medical AI(abstract)

AI总结 SafeMed-R1通过对抗训练与组相对策略优化提升视觉-语言模型在医疗推理中的鲁棒性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02710 2025-12-03 cs.CE 50%

Beyond N-grams: A Hierarchical Reward Learning Framework for Clinically-Aware Medical Report Generation

超越n-gram:一种面向临床意识的医疗报告生成层次奖励学习框架

Yuan Wang, Shujian Gao, Jiaxiang Liu, Songtao Jiang, Haoxiang Xia, Xiaotian Zhang, Zhaolu Kang, Yemin Wang, Zuozhu Liu

专题命中 医疗多模态 :diagnosis(abstract)

AI总结 本文提出HiMed-RL框架,通过层次化奖励学习提升医疗报告生成的临床质量与事实准确性。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19546 2025-11-26 cs.AI cs.CL cs.HC 50%

CNS-Obsidian: A Neurosurgical Vision-Language Model Built From Scientific Publications

CNS-Obsidian:基于科学出版物构建的神经外科视觉-语言模型

Anton Alyakin, Jaden Stryker, Daniel Alexander Alber, Jin Vivian Lee, Karl L. Sangwon, Brandon Duderstadt, Akshay Save, David Kurland, Spencer Frome, Shrutika Singh, Jeff Zhang, Eunice Yang, Ki Yun Park, Cordelia Orillac, Aly A. Valliani, Sean Neifert, Albert Liu, Aneek Patel, Christopher Livia, Darryl Lau, Ilya Laufer, Peter A. Rozman, Eveline Teresa Hidalgo, Howard Riina, Rui Feng, Todd Hollon, Yindalon Aphinyanaphongs, John G. Golfinos, Laura Snyder, Eric Leuthardt, Douglas Kondziolka, Eric Karl Oermann

专题命中 医疗多模态 :diagnosis(abstract)

AI总结 CNS-Obsidian是一款基于科学文献训练的神经外科视觉-语言模型,通过对比实验展示了其在诊断准确性与用户评分上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18320 2025-11-25 physics.med-ph physics.bio-ph physics.optics 50%

Comprehensive Multimodal and Multiscale Analysis of Alzheimer Disease in 5xFAD Mice: Optical Spectroscopies, TEM, Neuropathological, and Behavioral Investigations

5xFAD小鼠阿尔茨海默病的综合多模态和多尺度分析:光学光谱学、TEM、神经病理学和行为研究

Dhruvil Solanki, Ishmael Apachigawo, Sazzad Khan, Santanu Maity, Fatemah Alharthi, Samia Nasim, Mohammad Alizadeh Poshtiri, Fnu Sweety, Jiangfeng Xiao, Mohammad Moshahid Khan, Prabhakar Pradhan

专题命中 医疗多模态 :pathology(abstract)

AI总结 本文通过多模态和多尺度分析,利用光谱学、TEM、神经病理学和行为研究,揭示了5xFAD小鼠中阿尔茨海默病的早期生物标志物和病理机制。

Comments 27 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04816 2025-11-10 stat.ME 50%

An Integrative Approach for Subtyping Mental Disorders Using Multimodal Data

Yinjun Zhao, Yuanjia Wang, Ying LIu

专题命中 医疗多模态 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.06455 2025-10-31 stat.AP 50%

Combining Unsupervised Learning and Statistical Inference For Multimodal N-of-1 Trials

Juliana Schneider, Thomas Gärtner, Stefan Konigorski

专题命中 医疗多模态 :medical image(abstract)

Comments 22 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22602 2025-10-28 cs.CL cs.AI cs.CY 50%

Personal Care Utility (PCU): Building the Health Infrastructure for Everyday Insight and Guidance

Mahyar Abbasian, Ramesh Jain

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 医疗多模态 :biomedical(abstract)

Comments 22 pages, 2 figures, 1 table, Journal paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22261 2025-09-29 cs.AI cs.CL 50%

InfiMed-Foundation: Pioneering Advanced Multimodal Medical Models with Compute-Efficient Pre-Training and Multi-Stage Fine-Tuning

Guanghao Zhu, Zhitian Hou, Zeyu Liu, Zhijie Sang, Congkai Xie, Hongxia Yang

机构 * The Hong Kong Polytechnic University(香港理工大学) Sun Yat-sen University(中山大学)

专题命中 医疗多模态 :radiology(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11944 2025-09-16 cs.AI 50%

Agentic Temporal Graph of Reasoning with Multimodal Language Models: A Potential AI Aid to Healthcare

Susanta Mitra

专题命中 医疗多模态 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11937 2025-09-16 cs.SE cs.AI 50%

MMORE: Massive Multimodal Open RAG & Extraction

Alexandre Sallinen, Stefan Krsteski, Paul Teiletche, Marc-Antoine Allard, Baptiste Lecoeur, Michael Zhang, Fabrice Nemo, David Kalajdzic, Matthias Meyer, Mary-Anne Hartley

机构 * École Polytechnique Fédérale de Lausanne (EPFL), Switzerland(瑞士联邦理工学院洛桑校区) ETH Zürich, Switzerland(瑞士苏黎世联邦理工学院) T.H. Chan School of Public Health, Harvard University, USA(哈佛大学T.H. Chan公共卫生学院)

专题命中 医疗多模态 :biomedical(abstract)

Comments This paper was originally submitted to the CODEML workshop for ICML 2025. 9 pages (including references and appendices)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18687 2025-08-27 cs.CL 50%

Knowing or Guessing? Robust Medical Visual Question Answering via Joint Consistency and Contrastive Learning

Songtao Jiang, Yuxi Chen, Sibo Song, Yan Zhang, Yeying Jin, Yang Feng, Jian Wu, Zuozhu Liu

机构 * Zhejiang University, Zhejiang, China(浙江大学) Alibaba Group, Zhejiang, China(阿里巴巴集团) Angelalign Technology Inc., Shanghai, China(Angelalign技术有限公司) ChohoTech Inc., Hangzhou, China(楚合科技有限公司) Zhejiang Key Laboratory of Medical Imaging Artificial Intelligence, Zhejiang, China(浙江省医学影像人工智能重点实验室)

专题命中 医疗多模态 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18608 2025-08-27 cs.AI 50%

eSkinHealth: A Multimodal Dataset for Neglected Tropical Skin Diseases

Janet Wang, Xin Hu, Yunbei Zhang, Diabate Almamy, Vagamon Bamba, Konan Amos Sébastien Koffi, Yao Koffi Aubin, Zhengming Ding, Jihun Hamm, Rie R. Yotsu

机构 * Tulane University(Tulane大学) Bakke Graduate University(Bakke研究生大学)

专题命中 医疗多模态 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13072 2025-08-19 cs.AI 50%

A Language-Signal-Vision Multimodal Framework for Multitask Cardiac Analysis

Yuting Zhang, Tiantian Geng, Luoying Hao, Xinxing Cheng, Alexander Thorley, Xiaoxia Wang, Wenqi Lu, Sandeep S Hothi, Lei Wei, Zhaowen Qiu, Dipak Kotecha, Jinming Duan

机构 * School of Computer Science, University of Birmingham, Birmingham, UK Department of Cardiovascular Sciences, University of Birmingham, Birmingham, UK NIHR Birmingham Biomedical Research Centre West Midlands NHS Secure Data Environment, University Hospitals Birmingham NHS Foundation Trust, Birmingham, UK Department of Computing Mathematics, Manchester Metropolitan University, Manchester, UK Department of Cardiology, Heart Lung Centre, Royal Wolverhampton NHS Trust, Wolverhampton, UK Department of Cardiovascular Surgery, The First Affiliated Hospital with Nanjing Medical University , Nanjing,China College of Computer Control Engineering, Northeast Forestry University, Harbin, China Julius Center, University Medical Center Utrecht, the Netherlands Data Sciences, University of Manchester, Manchester, UK

专题命中 医疗多模态 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08224 2025-08-14 cs.CL cs.AI 50%

Capabilities of GPT-5 on Multimodal Medical Reasoning

Shansong Wang, Mingzhe Hu, Qiang Li, Mojtaba Safari, Xiaofeng Yang

机构 * Department of Radiation Oncology, Winship Cancer Institute, Emory University School of Medicine(放射肿瘤科、Winship癌症研究所、埃默里大学医学院)

专题命中 医疗多模态 :medical image(abstract)

Comments Corrected some typos

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02525 2025-08-05 cs.AI 50%

Accurate and Interpretable Postmenstrual Age Prediction via Multimodal Large Language Model

Qifan Chen, Jin Cui, Cindy Duan, Yushuo Han, Yifei Shi

机构 * King’s College London(伦敦国王学院) Imperial College London(帝国理工学院) Columbia University(哥伦比亚大学)

专题命中 医疗多模态 :MRI(abstract)

Comments Submitted to the NeurIPS 2025 Workshop GenAI4Health. Conference website: https://aihealth.ischool.utexas.edu/GenAI4HealthNeurips2025/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12786 2025-07-18 physics.optics 50%

Plasmonic Color Filters Enable Label-Free Plasmon-Enhanced Array Tomography with sub-diffraction limited resolution

Kristian Caracciolo, Eugeniu Balaur, Erinna F. Lee, W. Douglas Fairlie, Julian Ratcliffe, Eric Hanssen, David Hoxley, Jacqueline Orian, Chad Johnson, Lu Yu, Kang Han, Wei Xiang, Brian Abbey

专题命中 医疗多模态 :biomedical(abstract)

Comments 24 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18212 2025-07-17 cs.RO 50%

Haptic-Informed ACT with a Soft Gripper and Recovery-Informed Training for Pseudo Oocyte Manipulation

Pedro Miguel Uriguen Eljuri, Hironobu Shibata, Maeyama Katsuyoshi, Yuanyuan Jia, Tadahiro Taniguchi

机构 * Kyoto University(京都大学) Ritsumeikan University(立命馆大学)

专题命中 医疗多模态 :biomedical(abstract)

Comments Accepted at IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS2025) Project website https://tanichu-laboratory.github.io/pedro_haptic_act_iros2025/

详情

展开后加载摘要…

URL PDF HTML 收藏