ChatVLA-2: Vision-Language-Action Model with Open-World Embodied Reasoning from Pretrained Knowledge
机构 * Midea Group(美的集团) ; East China Normal University(华东师范大学)
专题命中 视觉推理 :vision-language model(abstract);VLM(abstract);分类 cs.CV、cs.AI
Comments Project page: https://chatvla-2.github.io/