DUAL-Bench: Measuring Over-Refusal and Robustness in Vision-Language Models
DUAL-Bench: 测量视觉语言模型中的过度拒绝与鲁棒性
机构 * Macquarie University(麦考瑞大学) ; MBZUAI(马克斯·普朗克智能系统研究所)
专题命中 评测与基准 :language model(title,abstract);分类 cs.CL
AI总结 本文提出DUAL-Bench,通过评估18种VLM在12类危险场景下的表现,揭示模型在双重使用场景中的脆弱安全边界,强调安全完成与过度拒绝的平衡需求。
Comments 26pages, 13 figures, Preprint