Localization-Infused Vision-Language Semantic Fusion for Text-Guided Medical Image Segmentation
用于文本引导医学图像分割的定位注入视觉语言语义融合
机构 * Air Force Engineering University(空军工程大学) ; Harbin Institute of Technology(哈尔滨工业大学) ; University of Sydney(悉尼大学) ; Institute of Translational Medicine, Shanghai Jiao Tong University(上海交通大学转化医学研究院) ; Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院)
专题命中 音视频/视觉语言融合 :information fusion(abstract);feature-level fusion(abstract);分类 cs.CV
AI总结 研究针对文本引导医学图像分割,提出LoG框架,通过联合执行多尺度目标定位任务,实现三级定位注入语义融合,在三个基准数据集实验中表现出色,优于现有医学图像分割方法。