MangaVQA and MangaLMM: A Benchmark and Specialized Model for Multimodal Manga Understanding
MangaVQA和MangaLMM:多模态漫画理解的基准和专用模型
机构 * The University of Tokyo(东京大学)
专题命中 多模态评测 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
AI总结 本文提出MangaVQA和MangaLMM,用于多模态漫画理解的基准和专用模型,通过视觉问答和文本识别任务提升漫画叙事理解能力。
Comments EACL 2026 Findings. Project page: https://manga109.github.io/MangaVQA_LMM/