Cost-Matching Model Predictive Control for Efficient Reinforcement Learning in Humanoid Locomotion
基于成本匹配的模型预测控制用于人形机器人高效强化学习
机构 * New York University Abu Dhabi (NYUAD)(纽约大学阿布扎比分校) ; Georgia Institute of Technology(佐治亚理工学院) ; Norwegian University of Science and Technology (NTNU)(挪威科技大学)
AI总结 本文提出一种基于模型预测控制的强化学习框架中的成本匹配方法,通过参数化MPC和中心动力学来近似高保真闭环数据获得的动作价值函数,提升人形机器人运动性能和鲁棒性。