G$^3$VLA: Geometric inductive bias for Vision-Language-Action Models
G$^3$VLA:视觉-语言-动作模型的几何归纳偏置
Yue Peng, Yongzhe Zhao, Artur Habuda, Khuyen Pham, Yanheng Zhu, Tran Nguyen Le, Fares Abu-Dakka, Li Guo
机构
*
New York University Shanghai(上海纽约大学)
;
Technical University of Denmark(丹麦技术大学)
;
MBZUAI - Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
;
New York University Abu Dhabi(纽约大学阿布扎比分校)
Neuro-Symbolic Drive: Rule-Grounded Faithful Reasoning for Driving VLAs
神经符号驱动:基于规则忠实推理的驾驶VLA
Xiangbo Gao, Xiukun Huang, Boyu Lu, Junge Zhang, Mengjie Mao, Jiachen Li, Wei Xiong, Zhengzhong Tu
机构
*
Texas A&M University(德克萨斯农工大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
University of Maryland(马里兰大学)
;
University of California, Riverside(加利福尼亚大学河滨分校)
;
University of Pittsburgh(匹兹堡大学)
Bridging Language and Action: A Survey of Language-Conditioned Robot Manipulation
连接语言与行动:语言引导的机器人操作综述
Xiangtong Yao, Hongkuan Zhou, Oier Mees, Yuan Meng, Ted Xiao, Yonatan Bisk, Jean Oh, Edward Johns, Mohit Shridhar, Dhruv Shah, Jesse Thomason, Kai Huang, Joyce Chai, Zhenshan Bing, Alois Knoll
机构
*
Technical University of Munich(慕尼黑技术大学)
;
Corporate Research, Robert Bosch GmbH(罗伯特·博世集团企业研究部)
;
University of California Berkeley(加州大学伯克利分校)
;
Microsoft(微软)
;
Google DeepMind(谷歌DeepMind)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Imperial College London(伦敦帝国理工学院)
;
Princeton University(普林斯顿大学)
;
University of Southern California(南加州大学)
;
Sun Yat-sen University(中山大学)
;
University of Michigan(密歇根大学)
;
Institute for Artificial Intelligence, University of Stuttgart(斯图加特大学人工智能研究所)
;
The State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室)