VLAMotor: Test-Guided Enhancement of Vision-Language-Action Models via Agent-BasedData Synthesis
VLAMotor: 通过基于智能体的数据合成实现视觉-语言-动作模型的测试引导增强
Zeqin Liao, Peifan Ren, Zixu Gao, Hongyu Gong, Lianyu Hu, Wenbing Tang, Yuhong Nan, Zibin Zheng, Yang Liu
机构
*
School of computing and data science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)
;
School of Software Engineering, Sun Yat-sen University(软件工程学院,中山大学)
;
GuangDong Engineering Technology Research Center of Blockchain, China(区块链工程技术研发中心,中国)
;
Northwest A&F University(西北农林科技大学)
Closed-Loop Neural Activation Control in Vision-Language-Action Models
视觉-语言-动作模型中的闭环神经激活控制
Abhijith Babu, Ramneet Kaur, Nathaniel D. Bastian, Olivera Kotevska, Susmit Jha, Yanzhao Wu, Sumit Kumar Jha, Anirban Roy
机构
*
Florida International University(佛罗里达国际大学)
;
SRI International(美国桑尼沃德国际研究机构)
;
United States Military Academy(美国军事学院)
;
Oak Ridge National Laboratory(橡树岭国家实验室)
;
University of Florida(佛罗里达大学)
From Abstraction to Instantiation: Learning Behavioral Representation for Vision-Language-Action Model
从抽象到实例化:学习视觉-语言-动作模型的行为表示
Bing Hu, Zaijing Li, Rui Shao, Junda Chen, April Hua Liu, Wei-Shi Zheng, Liqiang Nie
机构
*
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
;
Shenzhen Loop Area Institute(深圳河套学院)
;
PengCheng Laboratory(鹏城实验室)
;
Sun Yat-sen University(中山大学)
;
Shanghai University of Finance(上海财经大学)
WALL-WM: Carving World Action Modeling at the Event Joints
WALL-WM:在事件关节处雕刻世界动作建模
Shalfun Li, Victor Yao, Charles Yang, Truth Qu, Regis Cheng, Ryan Yu, Howard Lu, Newton Von, Vincent Chen, Yohann Tang, Maeve Zhang, Ellie Ma, Gody Li, Sage Yang, Lorien Shu, J. W. Gao, Ethan Chen, Colin Ye, Yu Sun, Elise Mon, PS Zhang, Neo Li, Lily Li, James Wang, Ping Yang, Chris Pan, Lucy Liang, Hang Su, Roy Gan, Hao Wang, Qian Wang
See, Plan, Rewind: Progress-Aware Vision-Language-Action Models for Robust Robotic Manipulation
看、规划、回退:面向鲁棒机器人操作的进度感知视觉-语言-动作模型
Tingjun Dai, Mingfei Han, Tingwen Du, Zhiheng Liu, Zihao Zhang, Zhihui Li, Salman Khan, Jun Yu, Xiaojun Chang
机构
*
School of Information Science and Technology, University of Science and Technology of China(信息科学与技术学院,中国科学技术大学)
;
University of Technology Sydney(新南威尔士大学)
;
Department of Computer Vision, Mohamed Bin Zayed University of Artificial Intelligence(人工智能与计算机视觉系,Mohamed Bin Zayed人工智能大学)
;
The University of Hong Kong(香港大学)
;
Institute of AI for Industry, Chinese Academy of Sciences(产业人工智能研究所,中国科学院)
;
School of Intelligent Science and Engineering, Harbin Institute of Technology (Shenzhen)(智能科学与工程学院,哈尔滨工业大学(深圳))
Co-training with Ego-centric Video and Demonstration for Robot Navigation Task
基于自我中心视频与示范的机器人导航任务协同训练
Shoya Kuno, Yumo Ouchi, Kanata Suzuki
机构
*
Department of Informatics, Graduate School of Informatics, Kyoto University(信息学系,京都大学研究生院)
;
Spatial Robotics Research Center, Fujitsu Limited(空间机器人研究中心,富士通有限公司)
Ryan Yu, Pushi Zhang, Starrick Liu, Brae Liu, Miracle Kang, Shalfun Li, Lights Shi, Ellie Ma, Ping Yang, Chris Pan, Jerry Chen, Dongxiu Liu, Rain Sun, Miles Guo, Byron Zhang, Hugo Zhou, Zach Xu, Vincent Chen, Harrison Huang, James Wang, Dance Kuzi, Andy Zhai, Hang Su, Roy Gan, Lucy Liang, Hao Wang, Qian Wang