Integrating Multimodal Large Language Model Knowledge into Amodal Completion
将多模态大语言模型知识整合到无模态补全中
机构 * KAIST(韩国科学技术院) ; AITRICS
专题命中 其他图像生成 :image generation(abstract);分类 cs.CV
AI总结 本文提出AmodalCG框架,利用多模态大语言模型知识指导无模态补全,通过评估遮挡程度选择性调用MLLM指导,结合视觉生成模型迭代优化补全结果,实验表明优于现有方法。