Discovering Failure Modes in Vision-Language Models using RL
通过强化学习发现视觉-语言模型的失败模式
机构 * Mila – Québec AI Institute(魁北克AI研究所) ; Université de Montréal(蒙特利尔大学) ; Michigan State University(密歇根州立大学) ; McGill University(麦吉尔大学) ; Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)
专题命中 幻觉与鲁棒性 :vision-language model(title,abstract);VLM(abstract,abstract_cn);分类 cs.CV、cs.AI
AI总结 本文提出基于强化学习的框架,自动发现视觉-语言模型在特定数据分布上的失败模式,通过生成问题来识别模型在细粒度视觉细节和技能组合上的不足。