ViSR-KGC: Visual Subgraph Reasoning with Vision-Language Models for Multimodal Knowledge Graph Completion
ViSR-KGC:结合视觉语言模型的视觉子图推理用于多模态知识图谱补全
机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) ; University of Chinese Academy of Sciences(中国科学院大学) ; CITIC Securities(中信证券) ; School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院)
AI总结 针对多模态知识图谱补全的痛点,提出ViSR-KGC方法,结合表示学习、视觉语言模型与预训练常识,通过提取查询感知子图并转换为可视化内容辅助VLM推理缺失实体。