SealQA: Raising the Bar for Reasoning in Search-Augmented Language Models
SealQA: 提升搜索增强语言模型在事实性问题中的推理能力
机构 * Virginia Tech(弗吉尼亚理工大学)
专题命中 工具调用 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 SealQA是一个新的挑战性基准,用于评估搜索增强语言模型在事实性问题上的能力,揭示当前模型在处理冲突、噪声或无用搜索结果时的局限性。
Comments Camera Ready version for ICLR 2026