FastOCR: Dynamic Visual Fixation via KV Cache Pruning for Efficient Document Parsing
FastOCR: 通过KV缓存剪枝实现高效的动态视觉聚焦文档解析
机构 * Tsinghua University(清华大学)
专题命中 文档图表理解 :vision-language model(abstract);分类 cs.CV
AI总结 本文提出FastOCR,一种无需训练的框架,通过动态视觉聚焦技术解决文档解析中的高效KV缓存剪枝问题,显著提升处理速度和准确性。