Aligning Compound AI Systems via System-level DPO
通过系统级DPO对复合AI系统进行对齐
机构 * Stanford University(斯坦福大学) ; University of Illinois Urbana Champaign(伊利诺伊大学厄巴纳-香槟分校) ; Mila Quebec AI Institute(魁北克AI研究院)
专题命中 偏好对齐 :DPO(title,abstract);alignment(abstract);分类 cs.AI、cs.LG
AI总结 本文提出SysDPO框架,通过系统级DPO实现复合AI系统的联合对齐,解决了组件间非可微分交互和系统偏好转换的问题。
Comments NeurIPS 2025