RAD-2: Scaling Reinforcement Learning in a Generator-Discriminator Framework
RAD-2: 在生成器-判别器框架中扩展强化学习
机构 * Huazhong University of Science & Technology(华中科技大学) ; Horizon Robotics
AI总结 RAD-2提出了一种生成器-判别器框架,通过扩散生成器生成轨迹候选并利用RL优化判别器评估长期驾驶质量,从而提升闭环规划的稳定性与安全性,实验显示碰撞率降低56%。
Comments Project page: https://hgao-cv.github.io/RAD-2