Beyond Imitation: Reinforcement Learning Fine-Tuning for Adaptive Diffusion Navigation Policies
超越模仿:用于自适应扩散导航策略的强化学习微调
机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) ; A*STAR, Singapore(A*STAR,新加坡) ; National University of Singapore, Singapore(新加坡国立大学)
专题命中 模仿学习与强化学习 :navigation(title,abstract);分类 cs.RO
AI总结 本文提出一种针对扩散导航的强化学习微调框架,通过Group Relative Policy Optimization提升策略适应性,在Isaac Sim中提升成功率和SPL,减少碰撞,展示出更强的零样本迁移能力和安全泛化能力。