VOLMO: Versatile and Open Large Models for Ophthalmology
VOLMO:面向眼科学的多功能和开放型大模型
Zhenyue Qin, Younjoon Chung, Elijah Lee, Wanyue Feng, Xuguang Ai, Serina Applebaum, Minjie Zou, Yang Liu, Pan Xiao, Mac Singer, Amisha Dave, Aidan Gilson, Tiarnan D. L. Keenan, Emily Y. Chew, Zhiyong Lu, Yih-Chung Tham, Ron Adelman, Luciano V. Del Priore, Qingyu Chen
机构
*
Department of Biomedical Informatics & Data Science, Yale University(耶鲁大学生物医学信息学与数据科学系)
;
Ray and Stephanie Lane Computational Biology Department, Carnegie Mellon University(卡内基梅隆大学雷和斯蒂芬妮·兰德计算生物学系)
;
Yong Loo Lin School of Medicine, National University of Singapore(新加坡国立大学杨洛林医学院)
;
Department of Radiology, Washington University in Saint Louis(圣路易斯华盛顿大学放射科)
;
National Eye Institute, National Institutes of Health(国家卫生研究院眼科研究所)
;
National Library of Medicine, National Institutes of Health(国家卫生研究院国家医学图书馆)
专题命中
VLM训练与架构
:LLaVA(abstract);InternVL(abstract);multimodal large language model(abstract);MLLM(abstract)
Huy Hoang Nguyen, Cédric Jung, Shirin Salehi, Tobias Glück, Anke Schmeink, Andreas Kugi
机构
*
AIT Austrian Institute of Technology(奥地利理工学院)
;
Automation & Control Institute, Technical University of Vienna(维也纳技术大学自动化与控制研究所)
;
Chair of Information Theory and Data Analytics (INDA), RWTH Aachen University(亚琛工业大学信息理论与数据分析教席)
GIFT: Global Irreplaceability Frame Targeting for Efficient Video Understanding
GIFT:全局不可替代性帧目标用于高效视频理解
Junpeng Ma, Sashuai Zhou, Guanghao Li, Xin Gao, Yue Cao, Hengyu Zeng, Yuxiang Yan, Zhibin Wang, Jun Song, Bo Zheng, Shanghang Zhang, Jian Pu
机构
*
Institute of Science and Technology for Brain-inspired Intelligence, Fudan University(复旦大学类脑智能科学与技术研究院)
;
State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室)
;
Zhejiang University(浙江大学)
;
Alibaba Group Holding Limited(阿里巴巴集团控股有限公司)
;
Future Living Lab of Alibaba(阿里巴巴未来生活实验室)