MemoryDocDataSet: A Benchmark for Joint Conversational Memory and Long Document Reasoning
MemoryDocDataSet: 联合对话记忆与长文档推理的基准测试
机构 * Northeastern University(东北大学) ; Johns Hopkins University(约翰霍普金斯大学) ; Columbia University(哥伦比亚大学) ; Independent Researcher(独立研究者)
专题命中 知识库问答 :RAG(abstract,abstract_cn);retrieval-augmented generation(abstract);分类 cs.CL、cs.AI
AI总结 提出MemoryDocDataSet合成基准,包含50个微世界和1000个QA对,评估系统同时处理多轮对话历史和长文档阅读理解的能力,其中75.1%的问题需要混合推理(先导航对话历史再提取文档答案),实验显示联合检索存在明显差距。
Comments 17 pages, 2 figures, 8 tables. Submitted for peer review