GlotOCR Bench: OCR Models Still Struggle Beyond a Handful of Unicode Scripts
GlotOCR Bench: OCR模型在超过少数Unicode脚本之外仍面临困难
机构 * LMU Munich(慕尼黑大学) ; TU Munich(慕尼黑工业大学) ; MCML ; Sorbonne Université & CNRS, ISIR(索邦大学与CNRS,ISIR)
专题命中 文档图表理解 :vision-language model(abstract);分类 cs.CV
AI总结 GlotOCR Bench评估OCR在100+Unicode脚本上的泛化能力,发现大多数模型在少于十种脚本上表现良好,最强模型也难以泛化到三十种以上脚本,表明当前OCR系统依赖语言模型预训练。