ClinFusion: A Vision-Centric Multimodal LLM System for Holistic Medical Understanding
ClinFusion:用于整体医学理解的以视觉为中心的多模态大语言模型系统
Hangjie Yuan, Yichen Qian, Zhiwei Tang, Xianzhe Xu, Lirong Wu, Sicheng Yang, Jinwang Wang, Pengju Wang, Zhitao Zeng, Yizeng Han, Yan Xing, Shengxuan Luo, Tao Feng, Qing Xie, Weigen Yao, Yi Yang, Zuozhu Liu, Jiasheng Tang, Shaocheng Wang, Jitao Wang, Jiahong Dong, Weihua Chen, Feng Xu, Fan Wang
机构
*
DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团)
;
Hupan Laboratory(湖畔实验室)
;
College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)
;
Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)
;
Department of Radiology, The Affiliated Yangming Hospital of Ningbo University(宁波大学附属阳明医院放射科)
;
Zhejiang University-University of Illinois Urbana-Champaign Institute, Zhejiang University(浙江大学伊利诺伊大学厄巴纳香槟校区联合学院,浙江大学)
;
Hepato-Pancreato-Biliary Center, Beijing Tsinghua Changgung Hospital, School of Clinical Medicine, Tsinghua Medicine, Tsinghua University(清华长庚医院肝胆胰中心,清华大学临床医学院,清华医学,清华大学)
;
School of Software, Tsinghua University(清华大学软件学院)
;
Beijing National Research Center for Information Science and Technology, Tsinghua University(清华大学北京信息科学与技术国家研究中心)
ChartNet: A Million-Scale, High-Quality Multimodal Dataset for Robust Chart Understanding
ChartNet: 一个百万级、高质量的多模态数据集,用于稳健的图表理解
Jovana Kondic, Pengyuan Li, Dhiraj Joshi, Isaac Sanchez, Ben Wiesel, Shafiq Abedin, Amit Alfassy, Eli Schwartz, Daniel Caraballo, Yagmur Gizem Cinar, Florian Scheidegger, Steven I. Ross, Daniel Karl I. Weidele, Hang Hua, Ekaterina Arutyunova, Roei Herzig, Zexue He, Zihan Wang, Xinyue Yu, Yunfei Zhao, Sicong Jiang, Minghao Liu, Qunshu Lin, Peter Staar, Luis Lastras, Aude Oliva, Rogerio Feris
机构
*
MIT(麻省理工学院)
;
MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室)
;
IBM Research(IBM研究院)
;
Abaka AI & 2077AI(Abaka AI及2077AI)
From UAV Imagery to Agronomic Reasoning: A Multimodal LLM Benchmark for Plant Phenotyping
从无人机图像到农学推理:一种多模态大语言模型基准用于植物表型分析
Yu Wu, Guangzeng Han, Ibra Niang Niang, Francia Ravelombola, Maiara Oliveira, Jason Davis, Dong Chen, Feng Lin, Xiaolei Huang
机构
*
University of Memphis(孟菲斯大学)
;
University of Missouri(密苏里大学)
;
University of Arkansas Division of Agriculture(阿肯色大学农业分部)
;
Mississippi State University(密西西比州立大学)
专题命中
多模态评测
:multimodal(title,abstract);multimodal foundation model(abstract);分类 cs.CV、cs.CL、cs.AI
Federated Prompt-Tuning with Heterogeneous and Incomplete Multimodal Client Data
联邦提示调优与异构且不完整多模态客户端数据
Thu Hang Phung, Duong M. Nguyen, Thanh Trung Huynh, Quoc Viet Hung Nguyen, Trong Nghia Hoang, Phi Le Nguyen
机构
*
Institute of AI Innovation and Societal Impact, Hanoi University of Science and Technology(人工智能创新与社会影响研究院,河内科学技术大学)
;
EPFL(瑞士联邦理工学院)
;
Griffith University(格里菲斯大学)
;
Washington State University(华盛顿州立大学)
机构
*
Shenzhen Stomatology Hospital (Pingshan) of Southern Medical University(南方医科大学深圳口腔医院(平山))
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
State Key Laboratory of Membrane Biology, Beijing Key Laboratory of Cardiometabolic Molecular Medicine, Institute of Molecular Medicine, National Biomedical Imaging Center, School of Future Technology, Peking University(北京大学膜生物学国家重点实验室、北京心代谢分子医学重点实验室、分子医学研究院、国家生物医学成像中心、未来技术学院)
;
Freedom AI
;
Division of Applied Oral Sciences & Community Dental Care Faculty of Dentistry, The University of Hong Kong(香港大学牙科学院应用口腔科学与社区牙科护理系)
;
Beijing Institute of Collaborative Innovation(北京协同创新研究院)
;
National Health Data Institute, Shenzhen(深圳国家健康数据研究院)
;
Shenzhen Loop Area Institute(深圳河套学院)
;
Shenzhen Institute of Big Data(深圳大数据研究院)
NeuroABench: A Multimodal Evaluation Benchmark for Neurosurgical Anatomy Identification
NeuroABench: 一种多模态评估基准,用于神经外科解剖识别
Ziyang Song, Zelin Zang, Xiaofan Ye, Boqiang Xu, Long Bai, Jinlin Wu, Hongliang Ren, Hongbin Liu, Jiebo Luo, Zhen Lei
机构
*
Hong Kong Institute of Science and Innovation(香港科学与创新研究院)
;
The University of Hong Kong-Shenzhen Hospital(香港大学深圳医院)
;
Department of Electronic Engineering, The Chinese University of Hong Kong(香港中文大学电子工程系)
Omni-Reward: Towards Generalist Omni-Modal Reward Modeling with Free-Form Preferences
Zhuoran Jin, Hongbang Yuan, Kejian Zhu, Jiachun Li, Pengfei Cao, Yubo Chen, Kang Liu, Jun Zhao
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
EMMA: End-to-End Multimodal Model for Autonomous Driving
Jyh-Jing Hwang, Runsheng Xu, Hubert Lin, Wei-Chih Hung, Jingwei Ji, Kristy Choi, Di Huang, Tong He, Paul Covington, Benjamin Sapp, Yin Zhou, James Guo, Dragomir Anguelov, Mingxing Tan
机构
*
College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机科学与软件工程学院)
;
School of Artificial Intelligence, Shenzhen University(深圳大学人工智能学院)
;
Guangdong Provincial Key Laboratory of Intelligent Information Processing(广东省智能信息处理重点实验室)
;
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
Renmin University of China(中国人民大学)
;
National Yang Ming Chiao Tung University
;
Taipei Veterans General Hospital(台北荣民总医院)
;
School of Biomedical Engineering, Shenzhen University(深圳大学生物医学工程学院)