RoMAN-Flow: Taming Autoregressive Normalizing Flows for Offline Reinforcement Learning in Robotic Manipulation
RoMAN-Flow:驯服自回归归一化流用于机器人操作中的离线强化学习
专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV
AI总结 该研究针对机器人操作离线强化学习中AR-NFs采样开销大的问题,提出RoMAN-Flow框架,通过无采样的优势加权似然目标和策略蒸馏方法,在保证性能的同时大幅降低推理延迟。