PRISM: Robust VLM Alignment with Principled Reasoning for Integrated Safety in Multimodality
PRISM:面向多模态集成安全的原理化推理对齐
机构 * Johns Hopkins University(约翰霍普金斯大学) ; Cornell University(康奈尔大学) ; Stanford University(斯坦福大学) ; NVIDIA(英伟达)
专题命中 偏好对齐 :alignment(title,abstract);safety(title,abstract);DPO(abstract);分类 cs.AI
AI总结 PRISM通过结构化四阶段推理过程,有效应对多模态安全违规,提升VLM的鲁棒性与安全性,同时保持模型实用性。