From Observation to Action: Latent Action-based Primitive Segmentation for VLA Pre-training in Industrial Settings
从观察到行动:用于工业场景中VLA预训练的基于动作的潜在原始分割
专题命中 机器人基础模型 :embodied AI(abstract);分类 cs.RO、cs.AI、cs.CV
AI总结 本文提出了一种无监督框架,利用连续工业视频流中的大量未标记人类示范数据进行VLA模型预训练。方法首先训练了一个轻量级运动分词器来编码运动动态,然后利用新的'潜在动作能量'度量来发现和分割语义连贯的动作原始片段。
Comments 10 pages, 5 figures, Accepted to CVPR 2026