PHASER: Phase-Aware and Semantic Experience Replay for Vision-Language-Action Models
PHASER: 面向视觉-语言-动作模型的相位感知与语义经验回放
机构 * Thrust of AI, HKUST(Guangzhou)(人工智能 thrust,香港科技大学(广州)) ; AI 2 Robotics, Shenzhen, China(人工智能与机器人,深圳,中国)
专题命中 VLA模型 :VLA(summary_cn,abstract);vision-language-action(title,abstract);action model(title);language-conditioned robot(abstract)
AI总结 提出PHASER框架,通过相位感知容量分配和多模态干扰路由策略,结合自动相位提取管线Auto-PC,解决VLA模型在持续学习中的灾难性遗忘问题,在LIBERO基准上平均成功率提升高达31%。
Comments 20 pages, 8 figures, 12 tables