TGV-KV: Text-Grounded KV Eviction for Vision-Language Models
TGV-KV:面向视觉语言模型的文本引导KV驱逐方法
机构 * University of Science and Technology of China(中国科学技术大学)
专题命中 VLM训练与架构 :vision-language model(title,abstract);LLaVA(abstract,abstract_cn);VLM(abstract_cn);分类 cs.CV
AI总结 针对视觉语言模型中视觉信息冗余导致的KV缓存内存消耗问题,提出基于文本引导的KV驱逐方法TGV-KV,通过文本-视觉预算分配、文本加权排序和文本优先保留策略,在保持高精度的同时显著提升推理吞吐量。
Comments Accepted by ICML-2026