APT: Action Expert Pretraining Improves Instruction Generalization of Vision-Language-Action Policies
APT: 动作专家预训练提升视觉-语言-动作策略的指令泛化能力
机构 * Zhejiang University(浙江大学) ; Zhejiang Humanoid Robot Innovation Center(浙江人形机器人创新中心)
专题命中 VLA模型 :vision-language-action(title,abstract);VLA(abstract,abstract_cn);分类 cs.RO
AI总结 针对连续动作专家模型对分布外语言指令泛化差的问题,提出APT两阶段训练方法,先预训练动作专家作为视觉-动作先验,再通过门控融合注入语言,显著提升泛化性能。