KBQA-R1: Reinforcing Large Language Models for Knowledge Base Question Answering
KBQA-R1:强化大语言模型用于知识库问答
机构 * University of Science and Technology of China(中国科学技术大学)
专题命中 视觉问答 :grounding(abstract)
AI总结 提出KBQA-R1框架,通过强化学习(GRPO)将知识库问答建模为多轮决策过程,并引入参考拒绝采样(RRS)解决冷启动问题,在多个基准上取得最优性能。
Comments ICML 2026