PACT: Self-Evolving Physical Safety Alignment for Diffusion Policies in Embodied Manipulation
PACT: 具身操作中扩散策略的自我演化物理安全对齐
机构 * Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center, Tsinghua University, Beijing, 100084, China(计算机科学与技术系,人工智能研究院,清华-博世联合机器学习中心,THBI实验室,BNRist中心,清华大学,北京,100084,中国) ; Peng Cheng Laboratory, 518108, China(鹏城实验室,518108,中国)
专题命中 后训练与偏好优化 :post-training(abstract);分类 cs.AI
AI总结 提出PACT框架,通过自演化后训练将预训练扩散策略投影到约束可行区域,无需演示数据或任务奖励,在降低31.0%安全违规的同时提升30.7%任务成功率。