Text-Aided Multi-Modal Panoptic Symbol Spotting for CAD Floor Plan Drawings
用于CAD平面图的文本辅助多模态全景符号识别
机构 * CCSE Lab, Beihang University(北京航空航天大学CCSE实验室) ; School of Transportation Science and Engineering, Beihang University(北京航空航天大学交通科学与工程学院) ; The Hong Kong Polytechnic University(香港理工大学)
专题命中 多模态训练与对齐 :multi-modal(title);multimodal(abstract);cross-modal(abstract);分类 cs.CV、cs.AI
AI总结 针对CAD平面图全景符号识别中现有方法未充分利用文本注释的问题,提出多模态框架TextCAD,设计TACE编码注释语义,引入语义层次对齐框架,实验表明该方法有效提升符号识别性能并达最优。