CoWorld-VLA: Thinking in a Multi-Expert World Model for Autonomous Driving
CoWorld-VLA:面向自动驾驶的多专家世界模型中的思考
Minqing Huang, Yujiao Xiang, Zihan Liang, Jiajie Huang, Jingqi Wang, Zhi Xu, Feiyang Tan, Hangning Zhou, Mu Yang, Gong Che
机构
*
Afari Intelligent Drive(Afari智能驾驶公司)
;
University of Electronic Science and Technology of China(电子科技大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Beijing University Of Posts and Telecommunications(北京邮电大学)
;
Tianjin University(天津大学)
ALAM: Algebraically Consistent Latent Action Model for Vision-Language-Action Models
ALAM:基于代数一致的潜在动作模型用于视觉-语言-动作模型
Zuojin Tang, Haoyun Liu, Xinyuan Chang, Changjie Wu, Dongjie Huo, Yandan Yang, Bin Liu, Zhejia Cai, Feng Xiong, Mu Xu, jiachen Luo, De Ma, Zhiheng Ma, Gang Pan
机构
*
Zhejiang University(浙江大学)
;
Amap, Alibaba Group(阿里集团阿地图)
;
Nanjing University(南京大学)
;
Shenzhen University of Advanced Technology(深圳先进技术大学)
;
Beijing University of Chemical Technology(北京化工大学)
;
Embodied Intelligence General Platform Laboratory, Chery Auto(奇瑞汽车 embodied intelligence 通用平台实验室)
;
Tsinghua University(清华大学)
;
Queen Mary University of London(伦敦大学玛丽女王学院)
FrameSkip: Learning from Fewer but More Informative Frames in VLA Training
FrameSkip: 从更信息丰富的较少帧中学习以在VLA训练中提升性能
Bin Yu, Shijie Lian, Xiaopeng Lin, Zhaolong Shen, Yuliang Wei, Changti Wu, Hang Yuan, Haishan Liu, Bailing Wang, Cong Huang, Kai Chen
机构
*
Harbin Institute of Technology(哈尔滨理工大学)
;
Zhongguancun Academy(中关村学院)
;
Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院)
;
Huazhong University of Science and Technology(华中科技大学)
;
East China Normal University(华东师范大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Beihang University(北航)
;
DeepCybo