REAP: Reinforcement-Learning End-to-End Autonomous Parking with Gaussian Splatting Simulator for Real2Sim2Real Transfer
REAP:基于高斯点扩散模拟器的端到端自主泊车强化学习
机构 * Shanghai Jiao Tong University(上海交通大学) ; Horizon Robotics Technology Research and Development Co., Ltd.(地平线机器人技术研究与开发有限公司)
AI总结 本文提出REAP方法,通过高斯点扩散模拟器实现Real2Sim2Real迁移,利用SAC算法提升训练效率,结合行为克隆和软预测碰撞惩罚机制,解决极端场景下的泊车问题。