Towards Robust Text-to-Image Person Retrieval: Multi-View Reformulation for Semantic Compensation
面向鲁棒的文本到图像人物检索:多视图重新公式化用于语义补偿
机构 * Beihang University(北航)
专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract)
AI总结 本文提出基于大语言模型的语义补偿框架,通过多视图语义重新公式化和特征补偿提升跨模态表示一致性,解决文本到图像检索中的表达漂移问题,实验表明其在三个数据集上表现优异。