$π$-StepNFT: Wider Space Needs Finer Steps in Online RL for Flow-based VLAs
$π$-StepNFT: 更宽的空间需要更细的步骤在线RL用于基于流的VLAs
专题命中 部署与泛化 :vision-language-action(abstract);VLA(abstract);分类 cs.RO、cs.CV
AI总结 $π$-StepNFT通过分步负向感知微调方法,在在线强化学习中提升基于流的VLAs的性能和泛化能力。
视觉与机器人
视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。
$π$-StepNFT: 更宽的空间需要更细的步骤在线RL用于基于流的VLAs
专题命中 部署与泛化 :vision-language-action(abstract);VLA(abstract);分类 cs.RO、cs.CV
AI总结 $π$-StepNFT通过分步负向感知微调方法,在在线强化学习中提升基于流的VLAs的性能和泛化能力。