XR-1: Towards Versatile Vision-Language-Action Models via Learning Unified Vision-Motion Representations
XR-1:通过学习统一的视觉-运动表示实现多功能的视觉-语言-动作模型
Shichao Fan, Kun Wu, Zhengping Che, Xinhua Wang, Di Wu, Fei Liao, Ning Liu, Yixue Zhang, Zhen Zhao, Zhiyuan Xu, Meng Li, Qingjie Liu, Shanghang Zhang, Min Wan, Jian Tang
机构
*
Beijing Innovation Center of Humanoid Robotics, Beijing, China(北京人形机器人创新中心,北京,中国)
;
School of Mechanical Engineering and Automation, Beihang University, Beijing, China(北京航空航天大学机械工程及自动化学院,北京,中国)
;
State Key Laboratory of Virtual Reality Technology and Systems, SCSE, Beihang University, Beijing, China(虚拟现实技术与系统国家重点实验室,SCSE,北京航空航天大学,北京,中国)
;
State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University, Beijing, China(多媒体信息处理国家重点实验室,计算机科学学院,北京大学,北京,中国)
机构
*
SKLCCSE Lab Beihang University Beijing China(SKLCCSE实验室 北航)
;
Department of Data Science City University of Hong Kong Hong Kong China(数据科学系 香港城市大学)
;
Beijing Advanced Innovation Center Beihang University Beijing China(北京先进创新中心 北航)
;
Beihang University(北航)
;
City University of Hong Kong(香港城市大学)
LLM-Driven Collaborative Model for Untangling Commits via Explicit and Implicit Dependency Reasoning
基于显式和隐式依赖推理的大语言模型驱动的提交解缠协作模型
Bo Hou, Xin Tan, Kai Zheng, Fang Liu, Yinghao Zhu, Li Zhang
机构
*
State Key Laboratory of Complex \& Critical Software Environment (SKLCCSE), School of Computer Science
;
Engineering, Beihang University Beijing China
;
SKLCCSE, School of Computer Science
;
School of Computing
;
Data Science, The University of Hong Kong Hong Kong SAR China
;
Engineering, Beihang University
;
Data Science, The University of Hong Kong