Stress-Testing Multimodal Foundation Models for Crystallographic Reasoning
Can Polat, Hasan Kurban, Erchin Serpedin, Mustafa Kurban
机构
*
Dept. of Electrical and Computer Engineering, Texas A&M University(电气与计算机工程系,德克萨斯A&M大学)
;
College of Science and Engineering, Hamad Bin Khalifa University(科学与工程学院,哈马德·本·卡西姆大学)
;
Dept. of Electrical and Computer Engineering, Texas A&M University at Qatar(电气与计算机工程系,德克萨斯A&M大学(卡塔尔))
;
Dept. of Prosthetics and Orthotics, Ankara University(假肢与矫形系,安卡拉大学)
专题命中
多模态评测
:multimodal(title,abstract);multimodal foundation model(title);分类 cs.CV、cs.CL
ClinHallu: A Benchmark for Diagnosing Stage-Wise Hallucinations in Medical MLLM Reasoning
ClinHallu: 用于诊断医学多模态大语言模型推理中阶段式幻觉的基准
Sicheng Yang, Hangjie Yuan, Wenjun Zhang, Jinwang Wang, Yichen Qian, Weihua Chen, Fan Wang, Lei Zhu
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
DAMO Academy, Alibaba Group(阿里巴巴达摩院)
;
Hupan Lab(湖畔实验室)
;
Zhejiang University(浙江大学)
MULTI: Multimodal Understanding Leaderboard with Text and Images
Zichen Zhu, Yang Xu, Lu Chen, Jingkai Yang, Yichuan Ma, Yiming Sun, Hailin Wen, Jiaqi Liu, Jinyu Cai, Yingzi Ma, Situo Zhang, Zihan Zhao, Liangtai Sun, Kai Yu
机构
*
X-LANCE Lab, School of Computer Science, Key Laboratory of Artificial Intelligence\ of Education, Shanghai Jiao Tong University, Shanghai 200240 , China
;
Jiangsu Key Lab of Language Computing, Suzhou 215123 , China
;
College of Computing
;
Data Science, Nanyang Technological University, Singapore 639798 , Singapore
;
Suzhou Laboratory, Suzhou 215123 , China
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Large Language Model Department, Tencent(腾讯大语言模型部)
;
University of Electronic Science and Technology of China(电子科技大学)
;
Hong Kong University of Science and Technology(香港科技大学)
;
Zhongguancun Academy(中关村学院)
机构
*
State Key Laboratory of Tribology, Department of Mechanical Engineering, Tsinghua University(摩擦学国家重点实验室,清华大学机械工程系)
;
Department of Statistics and Data Science, Yale University(耶鲁大学统计与数据科学系)
专题命中
多模态评测
:multimodal(title,abstract);multimodal foundation model(title);分类 cs.AI
MULTISEISMO: A Multimodal Seismic Dataset and Model for Cross-Modal Seismic Understanding
MULTISEISMO: 面向跨模态地震理解的多模态地震数据集与模型
Sai Munikoti, Ian Stewart, Chengping Chai, Lisa Linville, Scott Vasquez, Sameera Horawalavithana, Karl Pazdernik
机构
*
Pacific Northwest National Laboratory(太平洋西北国家实验室)
;
Oak Ridge National Laboratory(橡树岭国家实验室)
;
Sandia National Laboratory(桑迪亚国家实验室)
;
North Carolina State University(北卡罗来纳州立大学)
MIRAGE: Multimodal foundation model and benchmark for comprehensive retinal OCT image analysis
José Morano, Botond Fazekas, Emese Sükei, Ronald Fecso, Taha Emre, Markus Gumpinger, Georg Faustmann, Marzieh Oghbaie, Ursula Schmidt-Erfurth, Hrvoje Bogunović
机构
*
Christian Doppler Laboratory for Artificial Intelligence in Retina(人工智能视网膜实验室)
;
Institute of Artificial Intelligence(人工智能研究所)
;
Center for Medical Data Science(医学数据科学中心)
;
Medical University of Vienna(维也纳医学大学)
;
Comprehensive Center for AI in Medicine(医学人工智能综合中心)
;
OPTIMA Lab(OPTIMA实验室)
;
Department of Ophthalmology(眼科学系)
专题命中
多模态评测
:multimodal(title,abstract);multimodal foundation model(title);分类 cs.CV
CommentsAccepted for publication in npj Digital Medicine