QuantVLA: Scale-Calibrated Post-Training Quantization for Vision-Language-Action Models
QuantVLA: 用于视觉-语言-动作模型的可扩展后训练量化
机构 * The Ohio State University(俄亥俄州立大学) ; University of Michigan(密歇根大学) ; City University of Hong Kong(香港城市大学)
专题命中 机器人基础模型 :embodied agent(abstract);分类 cs.LG
AI总结 QuantVLA是一种无需训练的后训练量化框架,首次应用于视觉-语言-动作系统,并成功量化了扩散变换器(DiT)动作头,通过三种可扩展组件实现了高效的低比特量化,显著提升任务成功率并降低内存消耗。
Comments CVPR2026