SceneParser: Hierarchical Scene Parsing for Visual Semantics Understanding
SceneParser: 用于视觉语义理解的分层场景解析
机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) ; Zhongguancun Academy(中关村学院) ; Huazhong University of Science and Technology(华中科技大学) ; Beijing University of Posts and Telecommunications(北京邮电大学) ; South China University of Technology(华南理工大学) ; University of Oxford(牛津大学) ; Peking University(北京大学)
AI总结 本文提出SceneParser,通过分层解析任务构建场景-对象-部件-功能的层次结构,利用结构完成伪标签和课程学习提升结构感知能力,实验表明其在复杂场景理解中表现更优。
Comments Preprint. Code, models, and dataset are provided in the manuscript