Automated Report-Derived Oncology VQA Benchmark for Evaluating Vision-Language Models on 3D Medical Imaging
自动化报告驱动的肿瘤学VQA基准:用于评估3D医学影像上的视觉-语言模型
Bo Liu, Hanxue Gu, Xiangru Li, Zheren Zhu, Jacob Ellison, Kang Wang, Janine M. Lupo, Yang Yang, Hui Lin
机构
*
UCSF–UC Berkeley Joint Graduate Program in Bioengineering(UCSF-伯克利生物工程联合研究生项目)
;
Department of Radiology, UCSF(UCSF放射科)
;
Department of Radiation Oncology, UCSF(UCSF放射肿瘤科)
TumorChain: Interleaved Multimodal Chain-of-Thought Reasoning for Traceable Clinical Tumor Analysis
TumorChain: 交错多模态链式推理用于可追溯的临床肿瘤分析
Sijing Li, Zhongwei Qiu, Jiang Liu, Wenqiao Zhang, Tianwei Lin, Yihan Xie, Jianxiang An, Boxiang Yun, Chenglin Yang, Jun Xiao, Guangyu Guo, Jiawen Yao, Wei Liu, Yuan Gao, Ke Yan, Weiwei Cao, Zhilin Zheng, Tony C. W. Mok, Kai Cao, Yu Shi, Jiuyu Zhang, Jian Zhou, Beng Chin Ooi, Yingda Xia, Ling Zhang
机构
*
Zhejiang University(浙江大学)
;
DAMO Academy, Alibaba Group(阿里集团达摩院)
;
Hupan Lab(虎扑实验室)
;
Shanghai Institution of Pancreatic Disease(上海胰腺疾病研究所)
;
Shengjing Hospital of China Medical University(中国医科大学盛京医院)
;
Sun Yat-sen University Cancer Center(中山大学肿瘤中心)
Merlin: A Computed Tomography Vision-Language Foundation Model and Dataset
Merlin:一种计算断层扫描视觉-语言基础模型和数据集
Louis Blankemeier, Ashwin Kumar, Joseph Paul Cohen, Jiaming Liu, Longchao Liu, Dave Van Veen, Syed Jamal Safdar Gardezi, Hongkun Yu, Magdalini Paschali, Zhihong Chen, Jean-Benoit Delbrouck, Eduardo Reis, Robbie Holland, Cesar Truyts, Christian Bluethgen, Yufu Wu, Long Lian, Malte Engmann Kjeldskov Jensen, Sophie Ostmeier, Maya Varma, Jeya Maria Jose Valanarasu, Zhongnan Fang, Zepeng Huo, Zaid Nabulsi, Diego Ardila, Wei-Hung Weng, Edson Amaro Junior, Neera Ahuja, Jason Fries, Nigam H. Shah, Greg Zaharchuk, Marc Willis, Adam Yala, Andrew Johnston, Robert D. Boutin, Andrew Wentland, Curtis P. Langlotz, Jason Hom, Sergios Gatidis, Akshay S. Chaudhari
机构
*
Stanford University(斯坦福大学)
;
Stanford Center for Artificial Intelligence in Medicine and Imaging(斯坦福大学医学与成像人工智能中心)
;
Department of Electrical Engineering(电气工程系)
;
University of California Berkeley(加州大学伯克利分校)
;
Department of Radiology(放射科)
;
University of Wisconsin-Madison(威斯康星大学麦迪逊分校)
;
Hospital Israelita Albert Einstein(以色列特医院阿尔伯特·爱因斯坦医院)
Generalist Foundation Models from a Multimodal Dataset for 3D Computed Tomography
从多模态数据集构建通用基础模型用于三维计算机断层扫描
Ibrahim Ethem Hamamci, Sezgin Er, Chenyu Wang, Furkan Almas, Ayse Gulnihan Simsek, Sevval Nil Esirgun, Irem Dogan, Omer Faruk Durugol, Benjamin Hou, Suprosanna Shit, Weicheng Dai, Murong Xu, Hadrien Reynaud, Muhammed Furkan Dasdelen, Bastian Wittmann, Tamaz Amiranashvili, Enis Simsar, Mehmet Simsar, Emine Bensu Erdemir, Abdullah Alanbay, Anjany Sekuboyina, Berkan Lafci, Ahmet Kaplan, Zhiyong Lu, Malgorzata Polacin, Bernhard Kainz, Christian Bluethgen, Kayhan Batmanghelich, Mehmet Kemal Ozdemir, Bjoern Menze
机构
*
Department of Quantitative Biomedicine, University of Zurich(苏黎世大学定量生物医学系)
;
ETH AI Center, ETH Zurich(苏黎世联邦理工学院人工智能中心)
;
International School of Medicine, Istanbul Medipol University(伊斯坦布尔梅迪波尔大学国际医学院)
;
Department of Electrical and Computer Engineering, Boston University(波士顿大学电气与计算机工程系)
;
Division of Intramural Research, National Institutes of Health(美国国立卫生研究院内部研究部)
;
Department of Computing, Imperial College London(伦敦帝国理工学院计算机系)
;
Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系)
;
Institute for Diagnostic and Interventional Radiology, University Hospital Zurich(苏黎世大学医院诊断与介入放射学研究所)
;
Department Artificial Intelligence in Biomedical Engineering, FAU Erlangen-Nürnberg(埃尔朗根-纽伦堡工业大学生物医学工程人工智能系)
Fairness-Aware Fine-Tuning of Vision-Language Models for Medical Glaucoma Diagnosis
面向医疗青光眼诊断的公平性感知视觉语言模型微调
Zijian Gu, Yuxi Liu, Zhenhao Zhang, Song Wang
机构
*
Department of Computer Science, University of Rochester, NY, USA(罗切斯特大学计算机科学系)
;
Biostatistics and Health Data Science, School of Medicine, Indiana University, Indianapolis, IN, USA(印第安纳大学医学院生物统计学与健康数据科学系)
;
Department of Computer Science, University of Central Florida, FL, USA(佛罗里达州立大学计算机科学系)
PolyPath: Adapting a Large Multimodal Model for Multi-slide Pathology Report Generation
Faruk Ahmed, Lin Yang, Tiam Jaroensri, Andrew Sellergren, Yossi Matias, Avinatan Hassidim, Greg S. Corrado, Dale R. Webster, Shravya Shetty, Shruthi Prabhakara, Yun Liu, Daniel Golden, Ellery Wulczyn, David F. Steiner
MedGPT-oss: Training a General-Purpose Vision-Language Model for Biomedicine
MedGPT-oss: 为生物医学训练一个通用的视觉-语言模型
Kai Zhang, Zhengqing Yuan, Cheng Peng, Songlin Zhao, Mengxian Lyu, Ziyi Chen, Yanfang Ye, Wei Liu, Ying Zhang, Kaleb E Smith, Lifang He, Lichao Sun, Yonghui Wu
机构
*
Department of Computer Science and Engineering, Lehigh University(莱斯大学计算机科学与工程系)
;
Department of Computer Science and Engineering, University of Notre Dame(圣母大学计算机科学与工程系)
;
Department of Health Outcomes & Biomedical Informatics, University of Florida(佛罗里达大学健康结果与生物医学信息学系)
;
Department of Radiation Oncology, Mayo Clinic(梅奥诊所放射肿瘤科)
;
Research Computing, University of Florida(佛罗里达大学研究计算中心)
;
AI Technology Center, NVIDIA(NVIDIA人工智能技术中心)
Boosting Vision Semantic Density with Anatomy Normality Modeling for Medical Vision-language Pre-training
Weiwei Cao, Jianpeng Zhang, Zhongyi Shui, Sinuo Wang, Zeli Chen, Xi Li, Le Lu, Xianghua Ye, Tingbo Liang, Qi Zhang, Ling Zhang
机构
*
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
DAMO Academy, Alibaba Group(阿里巴巴集团达摩院)
;
The First Affiliated Hospital of College of Medicine, Zhejiang University(浙江大学医学院附属第一医院)
;
Hupan Lab(虎盘实验室)
Causal Representation Learning from Multimodal Biomedical Observations
Yuewen Sun, Lingjing Kong, Guangyi Chen, Loka Li, Gongxu Luo, Zijian Li, Yixuan Zhang, Yujia Zheng, Mengyue Yang, Petar Stojanov, Eran Segal, Eric P. Xing, Kun Zhang