Interactionless Inverse Reinforcement Learning: A Data-Centric Framework for Durable Alignment
无交互逆强化学习:一种数据驱动的对齐框架
机构 * IDLab, Ghent University - imec(IDLab,根特大学-imec)
专题命中 安全训练 :alignment(title,abstract);safety(abstract);分类 cs.LG
AI总结 本文提出无交互逆强化学习框架,旨在通过数据驱动的方法学习可检查、可编辑和可重用的奖励特征,从而将对齐问题从一次性训练成本转变为可验证的工程资产。
Comments Accepted for the AAMAS 2026 Blue Sky Ideas track