Learning More from Less: Reinforcement Learning from Hindsight
从更少中学习更多:事后诸葛亮式强化学习
Iris Xu, Sunshine Jiang, John Marangola, Nitish Dashora, Richard Li, Thomas Liu, Zexue He, Yuheng Zhi, Alex Pentland, Pulkit Agrawal, Zhang-Wei Hong
机构
*
Massachusetts Institute of Technology(麻省理工学院)
;
MIT-IBM Computing Research Lab(麻省理工学院-IBM计算研究实验室)
;
Stanford University(斯坦福大学)
;
University of California, San Diego(加利福尼亚大学圣地亚哥分校)