Trajectory-Regularized Stochastic Optimal Control via KL Divergence
通过 KL 散度的轨迹正则化随机最优控制
机构 * Hybrid Robotics(混合机器人实验室) ; UC Berkeley(伯克利大学)
AI总结 研究通过引入轨迹正则化随机最优控制(TRSOC),利用 KL 散度增强标准随机最优控制,推导 HJB 方程刻画最优策略,在 LQ 设置中有闭式解,实验表明正则化参数能在性能与参考保持间权衡。
Comments 8 pages, 4 figures, 65th IEEE Conference on Decision and Control