Safe Reinforcement Learning using Ideas from Model Predictive Control
利用模型预测控制思想的安全强化学习
机构 * Salzburg University of Applied Sciences(萨尔茨堡应用科学大学) ; Paris Lodron University of Salzburg(萨尔茨堡巴黎洛德伦大学)
专题命中 模仿学习与强化学习 :robotics(abstract);分类 cs.RO、cs.LG
AI总结 针对强化学习在安全约束方面的挑战,提出结合深度强化学习与模型预测控制的通用框架,利用系统动力学模型定义可行状态 - 动作空间,经安全过滤器投影动作,在实验室试验台验证该方法可成功探索并稳定收敛。
Comments Accepted at Eurocast 2026