DINOde: Continuous Vision-Text Alignment for Open-Vocabulary Semantic Segmentation
DINOde:用于开放词汇语义分割的连续视觉-文本对齐
机构 * Multimodal Intelligence and Perception Lab., DGIST(多模态智能与感知实验室,大邱庆北科学技术院) ; Visual Intelligence Lab., KAIST(视觉智能实验室,韩国科学技术院)
AI总结 研究针对开放词汇语义分割中视觉与文本对齐问题,提出基于ODE的DINOde框架,通过语义文本流和全局上下文流、速度切向投影等组件,连续对齐视觉与文本,实验证明该方法优于现有方法,性能达领先水平。
Comments Accepted to ECCV 2026. 27 pages, 8 figures, and 10 tables. Includes supplementary material