Towards Joint Quantization and Token Pruning of Vision-Language Models
面向视觉-语言模型的联合量化与令牌剪枝
机构 * VCIP, College of Computer Science, Nankai University(VCIP,计算机科学学院,南开大学) ; School of Computer Science and Engineering, Tianjin University of Technology(计算机科学与工程学院,天津工业大学) ; OPPO Research Institute(OPPO研究院) ; Academy for Advanced Interdisciplinary Studies, Nankai University(先进跨学科研究院,南开大学) ; Nankai International Advanced Research Institute, Shenzhen Futian(南开国际先进研究 institutes,深圳福田) ; Department of Computing, Hong Kong Polytechnic University(计算学院,香港理工大学)
AI总结 本文提出联合量化与令牌剪枝框架,通过统一低比特推理和确定性视觉令牌剪枝,提升视觉-语言模型在低比特下的鲁棒性与效率。