OliveGemma: A 3 Billion Visual Language Model for Recognising the Mediterranean & European Diet
OliveGemma:一款用于识别地中海与欧洲饮食的30亿参数视觉语言模型
专题命中 VLM训练与架构 :VLM(summary_cn,abstract);visual language model(title);vision language model(abstract);分类 cs.CV、cs.AI
AI总结 本研究构建基于PaliGemma-2-3B的OliveGemma,经LoRA微调后在欧洲饮食识别任务上超越多数前沿模型,仅逊于DenseNet-121,小型VLM经PEFT适配可在专业任务超越大模型。