FinMMDocR: Benchmarking Financial Multimodal Reasoning with Scenario Awareness, Document Understanding, and Multi-Step Computation
FinMMDocR:基于场景意识、文档理解与多步骤计算的金融多模态推理基准测试
专题命中 跨模态检索 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
AI总结 FinMMDocR通过引入场景意识、文档理解和多步骤计算,推动多模态大语言模型在现实金融场景中的推理能力提升,其包含12种隐含金融场景、9类丰富文档及平均11步推理任务。
Comments Accepted by AAAI-26 Main Track
Journal ref Proc. AAAI 2026 (Vol. 40, No. 30), pages 25858-25866