Shortcut Trajectory Planning for Efficient Offline Reinforcement Learning
用于高效离线强化学习的捷径轨迹规划
机构 * The University of Tokyo(东京大学)
专题命中 仿真与规划 :model-based reinforcement learning(abstract);分类 cs.AI、cs.LG、cs.RO
AI总结 研究针对离线强化学习中轨迹规划器的问题,提出捷径轨迹规划(STP)框架,将捷径模型作为轨迹生成器,单阶段训练条件捷径轨迹模型,支持可调推理,用增强可行性感知校正的评论家选候选计划,在多任务基准测试中性能强且简化训练管道。
Comments 16 pages, 3 figures