In-Context Reinforcement Learning via Communicative World Models
通过通信世界模型进行上下文强化学习
机构 * Department of Computer and Information Sciences, Fordham University(福特汉姆大学计算机与信息科学系) ; Department of Systems Engineering, City University of Hong Kong(香港城市大学系统工程系) ; IBM Research(IBM研究院)
专题命中 模仿学习与强化学习 :world model(title,abstract);分类 cs.AI、cs.LG
AI总结 提出CORAL框架,通过将潜在表示学习与控制分离,利用信息代理预训练世界模型并生成通信消息,使控制代理实现零样本适应和样本效率提升。