ExToken: Structured Exploration for Efficient Vision-Language-Action Reinforcement Fine-tuning
ExToken:用于高效视觉-语言-动作强化微调的结构化探索
机构 * Nanyang Technological University(南洋理工大学) ; ACE Robotics(ACE机器人公司) ; Zhejiang University(浙江大学)
专题命中 VLA模型 :VLA(summary_cn,abstract);vision-language-action(title,abstract);分类 cs.RO
AI总结 研究VLA模型强化学习中探索停滞问题,提出ExToken框架,基于离线演示导出的离散行为先验调整VLA策略进行结构化探索,通过不同令牌鼓励多样行为模式,提升了探索效率与任务性能,在多任务实验中表现良好。