Model-Based Learning of Near-Optimal Finite-Window Policies in POMDPs
基于模型的学习在POMDPs中近最优有限窗口策略
机构 * SYCAMORE group, Institute of Mechanical Engineering, EPFL(SYCAMORE小组,机械工程研究所,瑞士洛桑联邦理工学院)
AI总结 研究基于模型的学习在POMDPs中有限窗口策略的近最优性,通过分析样本复杂性,提出高效的模型估计方法,结合价值迭代获得近最优策略。