Knowledge Reutilization in Meta-Reinforcement Learning
元强化学习中的知识复用
机构 * State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) ; Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)
专题命中 规划决策 :agent(abstract);分类 cs.AI
AI总结 提出一种元知识复用框架,通过动力学简化智能体学习任务知识并迁移至异构智能体,利用贝叶斯非参数先验和高层策略生成任务级指导,显著降低跟踪误差并提高样本效率。
Comments 18 pages initial submission