MER-Bench: A Comprehensive Benchmark for Multimodal Meme Reappraisal
MER-Bench:多模态表情包再解释的综合基准
Yiqi Nie, Fei Wang, Junjie Chen, Kun Li, Yudi Cai, Dan Guo, Chenglong Li, Meng Wang
机构
*
School of Artificial Intelligence, Anhui University(安徽大学人工智能学院)
;
Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)
;
School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院)
;
College of Information Technology, United Arab Emirates University(阿拉伯联合酋长国大学信息学院)
;
Institute of Advanced Technology, University of Science and Technology of China(中国科学技术大学先进技术研究院)
A comprehensive multimodal dataset and benchmark for ulcerative colitis scoring in endoscopy
一种全面的多模态数据集和基准用于内镜溃疡性结肠炎评分
Noha Ghatwary, Jiangbei Yue, Ahmed Elgendy, Hanna Nagdy, Ahmed Galal, Hayam Fathy, Hussein El-Amin, Venkataraman Subramanian, Noor Mohammed, Gilberto Ochoa-Ruiz, Sharib Ali
Opportunistic Cardiac Health Assessment: Estimating Phenotypes from Localizer MRI through Multi-Modal Representations
机会性心脏健康评估:通过多模态表示从局部定位MRI估计表型
Busra Nur Zeybek, Özgün Turgut, Yundi Zhang, Jiazhen Pan, Robert Graf, Sophie Starck, Daniel Rueckert, Sevgi Gokce Kafali
机构
*
Chair for AI in Healthcare and Medicine, Technical University of Munich (TUM) and TUM University Hospital(人工智能在医疗与健康中的研究所,慕尼黑技术大学(TUM)和TUM大学医院)
;
Department of Diagnostic and Interventional Neuroradiology, School of Medicine, TUM University Hospital(诊断与介入神经放射科,医学院,TUM大学医院)
;
Department of Computing, Imperial College London(计算学院,伦敦帝国学院)
;
Munich Center for Machine Learning (MCML), Germany(慕尼黑机器学习中心(MCML),德国)
MIBench: Evaluating LMMs on Multimodal Interaction
MIBench: 评估大多模态模型在多模态交互中的能力
Yu Miao, Zequn Yang, Yake Wei, Ziheng Chen, Haotian Ni, Haodong Duan, Kai Chen, Di Hu
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China, Beijing, China(中国人民大学人工智能学院,北京,中国)
;
Beijing Key Laboratory of Research on Large Models(大型模型研究关键实验室)
;
Beihang University, Beijing, China(北京航空航天大学,北京,中国)
;
Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室,上海,中国)
UAV traffic scene understanding: A regulation embedded multi-modal network and a unified benchmark
无人机交通场景理解:一种嵌入监管的多模态网络和一个统一的基准
Yu Zhang, Zhicheng Zhao, Ze Luo, Chenglong Li, Jin Tang
机构
*
Computer Network Information Center, Chinese Academy of Sciences, Beijing 100190, China(中国科学院计算机网络信息中心,北京100190,中国)
;
University of Chinese Academy of Sciences, Beijing 100190, China(中国科学院大学,北京100190,中国)
;
Anhui Provincial Key Laboratory of Multi-modal Cognitive Computation, Anhui University, Hefei 230601, China(安徽省多模态认知计算重点实验室,安徽大学,合肥230601,中国)
;
Information Materials and Intelligent Sensing Laboratory of Anhui Province, Anhui University, Hefei 230601, China(安徽省信息材料与智能感知实验室,安徽大学,合肥230601,中国)
Localizing Before Answering: A Hallucination Evaluation Benchmark for Grounded Medical Multimodal LLMs
先定位后回答:一种用于基于地面的医学多模态大语言模型的幻觉评估基准
Dung Nguyen, Minh Khoi Ho, Huy Ta, Thanh Tam Nguyen, Qi Chen, Kumar Rav, Quy Duong Dang, Satwik Ramchandre, Son Lam Phung, Zhibin Liao, Minh-Son To, Johan Verjans, Phi Le Nguyen, Vu Minh Hieu Phan
Patient-Level Multimodal Question Answering from Multi-Site Auscultation Recordings
多站点听诊录音的患者级多模态问答
Fan Wu, Tsai-Ning Wang, Nicolas Zumarraga, Ning Wang, Markus Kreft, Kevin O'Sullivan, Elgar Fleisch, Oliver Aalami, Paul Schmiedmayer, Robert Jakob, Patrick Langer
机构
*
Agentic Systems Lab, ETH Zurich(伦理学院系统实验室,苏黎世联邦理工学院)
;
Eindhoven University of Technology(埃因霍温理工大学)
;
Centre for Digital Health Interventions, ETH Zurich(数字健康干预中心,苏黎世联邦理工学院)
;
Centre for Digital Health Interventions, University of St. Gallen(数字健康干预中心,圣加尔登大学)
;
Stanford Mussallem Center for Biodesign, Stanford University(斯坦福穆萨勒姆生物设计中心,斯坦福大学)
Integrating Personality into Digital Humans: A Review of LLM-Driven Approaches for Virtual Reality
将人格融入数字人类:一种基于大语言模型的虚拟现实方法综述
Iago Alves Brito, Julia Soares Dollis, Fernanda Bufon Färber, Pedro Schindler Freire Brasil Ribeiro, Rafael Teixeira Sousa, Arlindo Rodrigues Galvão Filho