AW-MoE: All-Weather Mixture of Experts for Robust Multi-Modal 3D Object Detection
AW-MoE:面向所有天气条件的专家混合方法用于鲁棒多模态3D目标检测
Hongwei Lin, Xun Huang, Chenglu Wen, Cheng Wang
机构
*
Fujian Key Laboratory of Urban Intelligent Sensing and Computing(福建城市智能感知与计算重点实验室)
;
School of Informatics, Xiamen University(厦门大学信息学院)
;
Zhongguancun Academy(中关村学院)
Can Multimodal LLMs See Science Instruction? Benchmarking Pedagogical Reasoning in K-12 Classroom Videos
多模态大语言模型能否看见科学教学?K-12课堂视频中教学推理的基准测试
Yixuan Shen, Peng He, Honglu Liu, Jinxuan Fan, Yuyang Ji, Tingting Li, Tianlong Chen, Kaidi Xu, Feng Liu
机构
*
Department of Computer Science, Drexel University(德雷塞尔大学计算机科学系)
;
Department of Teaching and Learning, Washington State University(华盛顿州立大学教学与学习系)
;
College of Chemistry, Beijing Normal University(北京师范大学化学学院)
;
Department of Computer Science, University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校计算机科学系)
;
Department of Data Science, City University of Hong Kong(香港城市大学数据科学系)
A comprehensive multimodal dataset and benchmark for ulcerative colitis scoring in endoscopy
一种全面的多模态数据集和基准用于内镜溃疡性结肠炎评分
Noha Ghatwary, Jiangbei Yue, Ahmed Elgendy, Hanna Nagdy, Ahmed Galal, Hayam Fathy, Hussein El-Amin, Venkataraman Subramanian, Noor Mohammed, Gilberto Ochoa-Ruiz, Sharib Ali
Opportunistic Cardiac Health Assessment: Estimating Phenotypes from Localizer MRI through Multi-Modal Representations
机会性心脏健康评估:通过多模态表示从局部定位MRI估计表型
Busra Nur Zeybek, Özgün Turgut, Yundi Zhang, Jiazhen Pan, Robert Graf, Sophie Starck, Daniel Rueckert, Sevgi Gokce Kafali
机构
*
Chair for AI in Healthcare and Medicine, Technical University of Munich (TUM) and TUM University Hospital(人工智能在医疗与健康中的研究所,慕尼黑技术大学(TUM)和TUM大学医院)
;
Department of Diagnostic and Interventional Neuroradiology, School of Medicine, TUM University Hospital(诊断与介入神经放射科,医学院,TUM大学医院)
;
Department of Computing, Imperial College London(计算学院,伦敦帝国学院)
;
Munich Center for Machine Learning (MCML), Germany(慕尼黑机器学习中心(MCML),德国)
MIBench: Evaluating LMMs on Multimodal Interaction
MIBench: 评估大多模态模型在多模态交互中的能力
Yu Miao, Zequn Yang, Yake Wei, Ziheng Chen, Haotian Ni, Haodong Duan, Kai Chen, Di Hu
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China, Beijing, China(中国人民大学人工智能学院,北京,中国)
;
Beijing Key Laboratory of Research on Large Models(大型模型研究关键实验室)
;
Beihang University, Beijing, China(北京航空航天大学,北京,中国)
;
Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室,上海,中国)
UAV traffic scene understanding: A regulation embedded multi-modal network and a unified benchmark
无人机交通场景理解:一种嵌入监管的多模态网络和一个统一的基准
Yu Zhang, Zhicheng Zhao, Ze Luo, Chenglong Li, Jin Tang
机构
*
Computer Network Information Center, Chinese Academy of Sciences, Beijing 100190, China(中国科学院计算机网络信息中心,北京100190,中国)
;
University of Chinese Academy of Sciences, Beijing 100190, China(中国科学院大学,北京100190,中国)
;
Anhui Provincial Key Laboratory of Multi-modal Cognitive Computation, Anhui University, Hefei 230601, China(安徽省多模态认知计算重点实验室,安徽大学,合肥230601,中国)
;
Information Materials and Intelligent Sensing Laboratory of Anhui Province, Anhui University, Hefei 230601, China(安徽省信息材料与智能感知实验室,安徽大学,合肥230601,中国)
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
Technology and Engineering Center for Space Utilization, Chinese Academy of Sciences(中国科学院空间利用技术与工程中心)
;
Nanjing University of Aeronautics and Astronautics(南京航空航天大学)
Evaluating GPT-5 as a Multimodal Clinical Reasoner: A Landscape Commentary
评估GPT-5作为多模态临床推理者的有效性:领域评论
Alexandru Florea, Shansong Wang, Mingzhe Hu, Qiang Li, Zach Eidex, Luke del Balzo, Mojtaba Safari, Xiaofeng Yang
机构
*
Department of Radiation Oncology, Winship Cancer Institute, Emory University School of Medicine(放射肿瘤科,Winship癌症研究所,埃默里大学医学院)
;
Department of Biomedical Engineering, Georgia Institute of Technology(生物医学工程系,佐治亚理工学院)
机构
*
Tsinghua University(清华大学)
;
University of South California(南加州大学)
;
Qwen Team, Alibaba Group(通义实验室,阿里巴巴集团)
;
University of California San Diego(南加州大学圣地亚哥分校)
;
Zhejiang University(浙江大学)
;
Shanghai Jiao Tong University(上海交通大学)