Learning to Walk With Less: A Dyna-Style Approach to Quadrupedal Locomotion
少数据驱动的四足机器人行走学习:一种Dyna式方法
专题命中 具身与机器人 :model-based reinforcement learning(abstract);分类 cs.AI、cs.RO;predictive model(abstract)
AI总结 该研究提出一种Dyna式方法,结合基于模型的技术改进PPO,在Unitree Go1等四足机器人模拟实验中,大幅减少收敛所需模拟步数与训练时间,同时保持策略性能。
Comments Accepted for publication in IEEE Access. 13 pages, 10 figures, 8 tables