SpecAlign: Efficient Specification-Grounded Alignment of Large Language Models via Synthetic Data
SpecAlign: 通过合成数据实现高效的大语言模型规范对齐
机构 * University of Notre Dame(圣母大学) ; Carnegie Mellon University(卡内基梅隆大学) ; LMU Munich(慕尼黑大学) ; University of Southern California(南加州大学)
专题命中 偏好对齐 :alignment(title,abstract);safety(abstract);分类 cs.AI
AI总结 提出规范对齐新范式,通过从规范文档合成数据(SpecAlign框架),结合结构化规则标注、可控规范实例化和多智能体对抗数据合成,生成细粒度偏好对,提升规则遵守度且不损害通用能力。
Comments 58 pages