RTPrune: Reading-Twice Inspired Token Pruning for Efficient DeepSeek-OCR Inference
RTPrune: 两次阅读启发的令牌修剪用于高效DeepSeek-OCR推理
机构 * Shanghai Jiao Tong University(上海交通大学) ; University of Science and Technology of China(中国科学技术大学) ; Tsinghua University(清华大学)
专题命中 文档图表理解 :vision-language model(abstract);分类 cs.CV、cs.LG
AI总结 本文提出RTPrune,一种针对DeepSeek-OCR的两次阶段令牌修剪方法,通过优先保留高范数视觉令牌并利用最优传输理论进行令牌配对和合并,从而在OCR任务中实现更高效的推理性能和更优的效率-精度权衡。
Comments 21 pages, accepted by ICML2026