HiPolicy: Hierarchical Multi-Frequency Action Chunking for Policy Learning
HiPolicy:分层多频动作分块用于策略学习
机构 * CFCS, School of CS, PKU(北京大学计算机学院计算与金融研究中心) ; National Key Laboratory for Multimedia Information Processing, School of CS, PKU(北京大学计算机学院多媒体信息处理国家重点实验室) ; XJTU(西安交通大学) ; THU(清华大学) ; BUAA(北京航空航天大学) ; Jingdong Technology Information Technology Co., Ltd(京东科技信息技术有限公司)
AI总结 HiPolicy通过分层多频动作分块框架,联合预测不同频率的动作序列,以捕捉粗粒度高层次计划和精确的反应动作,提升策略学习的性能和执行效率。