BridgeVLA: Input-Output Alignment for Efficient 3D Manipulation Learning with Vision-Language Models
机构 * CASIA(中国科学院自动化研究所) ; ByteDance Seed(字节跳动种子实验室) ; UCAS(中国科学院大学) ; FiveAges ; NJU(南京大学)
专题命中 VLA模型 :vision-language-action(abstract);VLA(abstract);分类 cs.RO、cs.AI
Comments NeurIPS 2025