CHDP: Cooperative Hybrid Diffusion Policies for Reinforcement Learning in Parameterized Action Space
CHDP:参数化动作空间中强化学习的协同混合扩散策略
机构 * National University of Singapore(新加坡国立大学) ; University of Science and Technology of China(中国科学技术大学)
AI总结 针对混合动作空间中的策略表达力不足和高维扩展性差问题,提出协同混合扩散策略框架,通过离散和连续扩散策略的协作与顺序更新,结合码本嵌入和Q函数引导,在基准测试中成功率提升高达19.3%。
Comments Accepted by AAAI 2026