Pragma-VL: Towards a Pragmatic Arbitration of Safety and Helpfulness in MLLMs
Pragma-VL:迈向多模态大语言模型中安全与助人的务实仲裁
机构 * Fudan University(复旦大学) ; Shanghai Innovation Institute(上海创新研究院) ; Ant Group(蚂蚁集团) ; Zhejiang University(浙江大学) ; UCLA(加州大学洛杉矶分校) ; Shenzhen Loop Area Institute(深圳河套学院)
专题命中 安全评测 :safety(title,abstract);alignment(abstract);分类 cs.AI、cs.LG
AI总结 Pragma-VL通过引入一种端到端的对齐算法,解决了多模态大语言模型在安全与助人之间的平衡问题,通过增强视觉风险感知和理论保证的奖励模型,在多数多模态安全基准上提升了性能。
Comments 31 pages, ICLR2026