Evaluating Vision-Language Models as a Zero-Shot Learning Alternative to You Only Look Once and Optical Character Recognition for Nigerian License Plate Recognition
评估视觉语言模型作为尼日利亚车牌识别的零样本学习替代方案:对比YOLO与光学字符识别
专题命中 文档图表理解 :vision-language model(title,abstract);VLM(summary_cn,abstract_cn);分类 cs.CV
AI总结 研究探索视觉语言模型作为尼日利亚车牌识别的统一零样本解决方案,在88张真实图像上评估5种VLM,发现Gemini和Qwen在字符错误率上显著优于YOLO+OCR。