Initialization matters in few-shot adaptation of vision-language models for histopathological image classification
初始化在视觉-语言模型少量样本适应中的重要性
Pablo Meseguer, Rocío del Amor, Valery Naranjo
机构
*
Instituto Universitario de Investigación en Tecnología Centrada en el Ser Humano (HUMAN-Tech)(人类中心技术研究所)
;
Universitat Politécnica de Valencia(巴塞罗那理工大学)
;
Valencian Graduate School and Research Network for Artificial Intelligence (valgrAI)(瓦伦西亚人工智能研究生院和研究网络)
专题命中
VLM训练与架构
:vision-language model(title);vision language model(abstract);VLM(abstract);分类 cs.CV
See-in-Pairs: Reference Image-Guided Comparative Vision-Language Models for Medical Diagnosis
See-in-Pairs: 用于医学诊断的参考图像引导的比较视觉-语言模型
Ruinan Jin, Gexin Huang, Xinwei Shen, Qiong Zhang, Yan Shuo Tan, Xiaoxiao Li
机构
*
Electrical and Computer Engineering Department, The University of British Columbia(不列颠哥伦比亚大学电气与计算机工程系)
;
Vector Institute(向量研究所)
;
ETH Zurich(苏黎世联邦理工学院)
;
Renmin University of China(中国人民大学)
;
National University of Singapore(新加坡国立大学)
AuditoryHuM: Auditory Scene Label Generation and Clustering using Human-MLLM Collaboration
AuditoryHuM: 利用人机协同生成和聚类听觉场景标签
Henry Zhong, Jörg M. Buchholz, Julian Maclaren, Simon Carlile, Richard F. Lyon
机构
*
Australian Hearing Hub, Macquarie University, Sydney, Australia(澳大利亚听力中心、麦觉里大学、悉尼、澳大利亚)
;
Google Research Australia, Sydney, Australia(谷歌澳大利亚研究、悉尼、澳大利亚)
专题命中
VLM训练与架构
:MLLM(title,abstract);multimodal large language model(abstract)
机构
*
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所)
;
Peng Cheng Laboratory(鹏城实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Peking University(北京大学)
机构
*
Shenzhen Technology University(深圳技术大学)
;
Shenzhen University of Information Technology(深圳信息科技学院)
;
University of Washington(华盛顿大学)
;
Foundation Model Team, Meituan(美团基础模型团队)
;
National University of Singapore(新加坡国立大学)
;
Tongji University(同济大学)
专题命中
VLM训练与架构
:multimodal large language model(abstract);分类 cs.CV、cs.AI