PPO-EAL: Exact Augmented Lagrangian Proximal Policy Optimization for Safe Robotic Control
PPO-EAL:用于安全机器人控制的精确增广拉格朗日近端策略优化
机构 * University of Trento(特伦托大学)
专题命中 模仿学习与强化学习 :robotic(title,abstract);分类 cs.RO
AI总结 提出PPO-EAL框架,将精确增广拉格朗日优化与近端策略优化结合,通过裁剪策略更新和精确二次惩罚项实现安全约束,在多种机器人任务中优于现有方法。
Comments 11 pages, 8 figures and 8 tables