FinMCP-Bench: Benchmarking LLM Agents for Real-World Financial Tool Use under the Model Context Protocol
FinMCP-Bench:基于模型上下文协议的LLM代理在真实金融工具使用中的基准测试
机构 * Qwen DianJin Team, Alibaba Cloud Computing(阿里云云计算千问点睛团队) ; YINGMI Wealth Management(盈米财富管理) ; Soochow University(苏州大学)
专题命中 工具调用 :tool use(title);分类 cs.AI、cs.CL
AI总结 本文提出FinMCP-Bench,用于评估LLM在解决真实金融问题时通过调用金融模型上下文协议的能力,包含613个样本,涵盖10种主要场景和33种子场景,提供真实和合成查询,评估不同任务复杂度下的模型表现。
Comments Accepted by ICASSP 2026