Personal Visual Context Learning in Large Multimodal Models
个人视觉上下文学习在大型多模态模型中
机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)
AI总结 本文提出个人视觉上下文学习(Personal VCL)以解决个性化查询,通过Personal-VCL-Bench评估,发现现有模型在利用视觉证据和聚合多视觉观察方面存在显著不足,提出Agentic Context Bank方法提升性能。
Comments Project website: https://vision.cs.utexas.edu/projects/PersonalVCL/