Fully Offline Reinforcement Learning
完全离线强化学习
专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG
AI总结 研究完全离线强化学习问题,提出基于贝叶斯模型的SOReL方法及扩展的TOReL方法,通过学习动力学后验、预测不确定性估计策略值实现完全离线超参数选择,建立实用且有理论基础的完全离线强化学习框架。
视觉与机器人
面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。
完全离线强化学习
专题命中 模型式强化学习 :model-based RL(abstract);分类 cs.AI、cs.LG
AI总结 研究完全离线强化学习问题,提出基于贝叶斯模型的SOReL方法及扩展的TOReL方法,通过学习动力学后验、预测不确定性估计策略值实现完全离线超参数选择,建立实用且有理论基础的完全离线强化学习框架。