VLSM-Ensemble: Ensembling CLIP-based Vision-Language Models for Enhanced Medical Image Segmentation
机构 * Insight Research Ireland Centre for Data Analytics, DCU, Dublin, Ireland(爱尔兰洞察研究爱尔兰数据分析中心,都柏林大学,都柏林) ; Research Ireland Centre for Research Training in Machine Learning, DCU, Dublin, Ireland(爱尔兰研究爱尔兰机器学习研究培训中心,都柏林大学,都柏林) ; School of Computing, Dublin City University, Dublin, Ireland(计算学院,都柏林城市大学,都柏林)
专题命中 视觉定位与Grounding :vision-language model(title,abstract);分类 cs.CV
Comments Medical Imaging with Deep Learning (MIDL 2025) short paper