FOCA: Future-Oriented Conditioning for Data-Efficient Vision-Language-Action Adaptation
FOCA: 面向未来的条件化用于数据高效的视觉-语言-动作适应
Duc Minh Nguyen, Nghiem Tuong Diep, Binh Gia Nguyen, Trong-Bao Ho, Doanh Le, Tan Q. Nguyen, Thien-Loc Ha, Nhiem Tran, Bao Thach, Nhat X. Tran, Tuan A. Tran, Artur Habuda, Philip Lund Møller, Tran Nguyen Le, Daniel Sonntag, Matthias Niepert, Khoa D. Doan, Vu Duong, Hung Ngo, Minh N. Vu, Duy M. H. Nguyen, An Thai Le, Ngo Anh Vien
机构
*
Center for AI Research, VinUniversity, Vietnam
;
University of Utah, USA
;
German Research Center for Artificial Intelligence (DFKI)
;
Technical University of Denmark, Denmark
;
University of Oldenburg, Germany
;
University of Stuttgart, Germany
;
Max Planck Research School for Intelligent Systems (IMPRS-IS), Germany
UAOR: Uncertainty-aware Observation Reinjection for Vision-Language-Action Models
UAOR: 面向视觉-语言-动作模型的不确定性感知观测重注入
Jiabing Yang, Yixiang Chen, Yuan Xu, Peiyan Li, Zichen Wen, Bowen Fang, Tao Yu, Xiangnan Wu, Qisen Ma, Kai Wang, Ziheng He, Yingda Li, Zhengbo Zhang, Jing Liu, Nianfeng Liu, Yan Huang, Liang Wang
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别新技术实验室)
;
Shanghai Jiao Tong University(上海交通大学)
;
FiveAges(五代)
机构
*
Peking University(北京大学)
;
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
The Chinese University of Hong Kong(香港中文大学)
;
Knowin AI
Bridging the Semantic-Action Gap in Visual Token Pruning for Efficient VLA Inference
弥合视觉令牌剪枝中的语义-动作鸿沟以实现高效VLA推理
Ziyan Liu, Yeqiu Chen, Hongyi Cai, Tao Lin, Shuo Yang, Zheng Liu, Bo Zhao
机构
*
School of AI, Shanghai Jiao Tong University(上海交通大学人工智能学院)
;
University of Science and Technology of China(中国科学技术大学)
;
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
;
BAAI(北京人工智能研究院)
机构
*
Institute for AI Industry Research (AIR)(人工智能产业研究院)
;
Department of Electronic Engineering(电子工程系)
;
University of Science and Technology of China(中国科学技术大学)
Offline Semantic Guidance for Efficient Vision-Language-Action Policy Distillation
离线语义引导用于高效视觉-语言-动作策略蒸馏
Jin Shi, Brady Zhang, Yishun Lu
机构
*
Department of Mechanical Engineering(机械工程系)
;
University College London(伦敦大学学院)
;
Department of Engineering Science(工程科学系)
;
University of Oxford(牛津大学)
AR-VLA: True Autoregressive Action Expert for Vision-Language-Action Models
AR-VLA:面向视觉-语言-动作模型的真自回归动作专家
Yutong Hu, Jan-Nico Zaech, Nikolay Nikolov, Yuanqi Yao, Sombit Dey, Giuliano Albanese, Renaud Detry, Luc Van Gool, Danda Paudel
机构
*
KU Leuven, Dept. Mechanical Engineering, Research unit Robotics, Automation and Mechatronics(库勒恩大学,机械工程系,机器人、自动化与机电一体化研究单位)
;
KU Leuven, Dept. Electrical Engineering, Research unit Processing Speech and Images(库勒恩大学,电气工程系,语音和图像处理研究单位)
Towards Deploying VLA without Fine-Tuning: Plug-and-Play Inference-Time VLA Policy Steering via Embodied Evolutionary Diffusion
迈向无需微调的VLA部署:通过具身进化扩散实现即插即用的推理时VLA策略引导
Zhuo Li, Junjia Liu, Zhipeng Dong, Tao Teng, Quentin Rouxel, Darwin Caldwell, Fei Chen
机构
*
Collaborative and Versatile Robots (CLOVER) Laboratory, T-Stone Robotics Institute, The Chinese University of Hong Kong, Hong Kong(协作与多功能机器人实验室,T-Stone机器人研究所,香港中文大学,香港)
;
Φ \Phi -Institute for Physical Human Intelligence(物理人机智能研究所)
;
Center for Embodied Artificial Intelligence and Computer Vision, Shenzhen Loop Area Institute, Shenzhen, China(具身人工智能与计算机视觉中心,深圳环园研究院,深圳,中国)
;
Department of Advanced Robotics, Istituto Italiano di Tecnologia, Genoa, Italy(先进机器人系,意大利理工学院,热那亚,意大利)