Repetition as Reinforcement: Enhancing Sample Efficiency via Instant Episode Repetition in Reinforcement Learning
重复作为强化:通过强化学习中的即时回合重复提升样本效率
专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG
AI总结 受人类学习的重复机制启发,提出即时回合重复(IER)机制,将其集成至 SAC、TD3 算法并在多类基准任务上验证,可提升强化学习的样本效率与学习性能。
Comments 23 pages, 12 figures. Accepted at RLC 2026; to appear in Reinforcement Learning Journal (RLJ) 2026. Code: https://github.com/UoA-CARES/instant-episode-repetition