EchoVLM: Dynamic Mixture-of-Experts Vision-Language Model for Universal Ultrasound Intelligence
EchoVLM:面向通用超声智能的动态专家混合视觉语言模型
机构 * School of iOPEN, Northwestern Polytechnical University(iOPEN学院,西北工业大学) ; The First Affiliated Hospital of Sun Yat-Sen University(中山大学附属第一医院) ; College of Mechanical Engineering, Tongji University(同济大学机械工程学院)
专题命中 视觉问答 :vision-language model(title,abstract);VLM(abstract);visual question answering(abstract);分类 cs.CV
AI总结 本文提出EchoVLM,通过动态混合专家架构提升超声图像的多任务诊断效率,实验表明其在报告生成任务中BLEU-1和ROUGE-1得分显著提升。