机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Tsinghua University(清华大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Sichuan University(四川大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
University of Chicago(芝加哥大学)
MER-Bench: A Comprehensive Benchmark for Multimodal Meme Reappraisal
MER-Bench:多模态表情包再解释的综合基准
Yiqi Nie, Fei Wang, Junjie Chen, Kun Li, Yudi Cai, Dan Guo, Chenglong Li, Meng Wang
机构
*
School of Artificial Intelligence, Anhui University(安徽大学人工智能学院)
;
Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)
;
School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院)
;
College of Information Technology, United Arab Emirates University(阿拉伯联合酋长国大学信息学院)
;
Institute of Advanced Technology, University of Science and Technology of China(中国科学技术大学先进技术研究院)
A comprehensive multimodal dataset and benchmark for ulcerative colitis scoring in endoscopy
一种全面的多模态数据集和基准用于内镜溃疡性结肠炎评分
Noha Ghatwary, Jiangbei Yue, Ahmed Elgendy, Hanna Nagdy, Ahmed Galal, Hayam Fathy, Hussein El-Amin, Venkataraman Subramanian, Noor Mohammed, Gilberto Ochoa-Ruiz, Sharib Ali
Opportunistic Cardiac Health Assessment: Estimating Phenotypes from Localizer MRI through Multi-Modal Representations
机会性心脏健康评估:通过多模态表示从局部定位MRI估计表型
Busra Nur Zeybek, Özgün Turgut, Yundi Zhang, Jiazhen Pan, Robert Graf, Sophie Starck, Daniel Rueckert, Sevgi Gokce Kafali
机构
*
Chair for AI in Healthcare and Medicine, Technical University of Munich (TUM) and TUM University Hospital(人工智能在医疗与健康中的研究所,慕尼黑技术大学(TUM)和TUM大学医院)
;
Department of Diagnostic and Interventional Neuroradiology, School of Medicine, TUM University Hospital(诊断与介入神经放射科,医学院,TUM大学医院)
;
Department of Computing, Imperial College London(计算学院,伦敦帝国学院)
;
Munich Center for Machine Learning (MCML), Germany(慕尼黑机器学习中心(MCML),德国)
MIBench: Evaluating LMMs on Multimodal Interaction
MIBench: 评估大多模态模型在多模态交互中的能力
Yu Miao, Zequn Yang, Yake Wei, Ziheng Chen, Haotian Ni, Haodong Duan, Kai Chen, Di Hu
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China, Beijing, China(中国人民大学人工智能学院,北京,中国)
;
Beijing Key Laboratory of Research on Large Models(大型模型研究关键实验室)
;
Beihang University, Beijing, China(北京航空航天大学,北京,中国)
;
Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室,上海,中国)
UAV traffic scene understanding: A regulation embedded multi-modal network and a unified benchmark
无人机交通场景理解:一种嵌入监管的多模态网络和一个统一的基准
Yu Zhang, Zhicheng Zhao, Ze Luo, Chenglong Li, Jin Tang
机构
*
Computer Network Information Center, Chinese Academy of Sciences, Beijing 100190, China(中国科学院计算机网络信息中心,北京100190,中国)
;
University of Chinese Academy of Sciences, Beijing 100190, China(中国科学院大学,北京100190,中国)
;
Anhui Provincial Key Laboratory of Multi-modal Cognitive Computation, Anhui University, Hefei 230601, China(安徽省多模态认知计算重点实验室,安徽大学,合肥230601,中国)
;
Information Materials and Intelligent Sensing Laboratory of Anhui Province, Anhui University, Hefei 230601, China(安徽省信息材料与智能感知实验室,安徽大学,合肥230601,中国)