VLAMotor: Test-Guided Enhancement of Vision-Language-Action Models via Agent-BasedData Synthesis
VLAMotor: 通过基于智能体的数据合成实现视觉-语言-动作模型的测试引导增强
Zeqin Liao, Peifan Ren, Zixu Gao, Hongyu Gong, Lianyu Hu, Wenbing Tang, Yuhong Nan, Zibin Zheng, Yang Liu
机构
*
School of computing and data science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)
;
School of Software Engineering, Sun Yat-sen University(软件工程学院,中山大学)
;
GuangDong Engineering Technology Research Center of Blockchain, China(区块链工程技术研发中心,中国)
;
Northwest A&F University(西北农林科技大学)
Ryan Yu, Pushi Zhang, Starrick Liu, Brae Liu, Miracle Kang, Shalfun Li, Lights Shi, Ellie Ma, Ping Yang, Chris Pan, Jerry Chen, Dongxiu Liu, Rain Sun, Miles Guo, Byron Zhang, Hugo Zhou, Zach Xu, Vincent Chen, Harrison Huang, James Wang, Dance Kuzi, Andy Zhai, Hang Su, Roy Gan, Lucy Liang, Hao Wang, Qian Wang
From Abstraction to Instantiation: Learning Behavioral Representation for Vision-Language-Action Model
从抽象到实例化:学习视觉-语言-动作模型的行为表示
Bing Hu, Zaijing Li, Rui Shao, Junda Chen, April Hua Liu, Wei-Shi Zheng, Liqiang Nie
机构
*
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
;
Shenzhen Loop Area Institute(深圳河套学院)
;
PengCheng Laboratory(鹏城实验室)
;
Sun Yat-sen University(中山大学)
;
Shanghai University of Finance(上海财经大学)
机构
*
Institute of Trustworthy Embodied AI (TEAI)(可信具身人工智能研究院)
;
Shanghai Key Laboratory of Multimodal Embodied AI(上海多模态具身人工智能重点实验室)
;
Shanghai Jiao Tong University(上海交通大学)
;
OpenDriveLab, The University of Hong Kong(OpenDrive实验室,香港大学)