DocOCR-Eval: A Correction-Based Framework for OCR Tool Selection Without Ground Truth
DocOCR-Eval:一种无需真实标签的基于校正的OCR工具选择框架
专题命中 文档图表理解 :MLLM(summary_cn,abstract_cn);visual question answering(abstract);multimodal large language model(abstract);分类 cs.AI、cs.LG
AI总结 针对文档解析中OCR工具选择难题,尤其是标签稀缺情况,提出无标注评估框架DocOCR-Eval。它采用三阶段校正和排序策略,通过跨多个MLLM聚合改善与基于标注排名的对齐,能在现实有限标签设置中实现可靠OCR工具选择并提供实用指导。
Comments Work in progress