HoloQ-VLA: Uniform W4A4 Quantization of Vision-Language-Action Models
Ω-QVLA: 通过复合旋转和逐步缩放实现视觉-语言-动作模型的鲁棒量化
机构 * McGill University(麦吉尔大学) ; Université de Montréal(蒙特利尔大学) ; Beijing University of Posts and Telecommunications(北京邮电大学) ; Shanghai Jiao Tong University(上海交通大学) ; Mila – Quebec AI Institute(魁北克AI研究所)
AI总结 提出Ω-QVLA,首个无需训练的后训练量化框架,通过复合SVD-Hadamard旋转和逐步DiT激活缩放量化,将VLA模型的语言骨干和扩散动作头统一压缩至W4A4精度,在LIBERO上达到或超越FP16性能,内存减少71.3%。