arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-07-29 至 2026-07-29 共收录 4 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 长文档RAG 4 篇

2601.15050 2026-07-29 cs.CL 版本更新 91%

Beyond Factual Accuracy: Evaluating Global Reasoning Integrity in RAG Systems with LogicScore

超越事实准确性:使用逻辑得分评估RAG系统中的全球推理完整性

Zhichao Yan, Yunxiao Zhao, Jiapu Wang, Jiaoyan Chen, Xiaoli Li, Ru Li, Jeff Z. Pan

机构 * Shanxi University(山西大学) Nanjing University of Science and Technology(南京理工大学) University of Manchester(曼彻斯特大学) Singapore University of Technology and Design(新加坡科技设计大学) University of Edinburgh(爱丁堡大学)

专题命中 长文档RAG :RAG(title,title_cn);retrieval augmented generation(abstract);分类 cs.CL

AI总结 本文提出LogicScore,通过全局推理审查弥补RAG系统在长文本生成中逻辑完整性不足的问题,揭示模型在事实准确性高但全局推理质量差的缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24767 2026-07-29 cs.IR cs.AI cs.CL 新提交 87%

The Effect of Text Chunk Size on Retrieval-Augmented Generation Performance

文本块大小对检索增强生成性能的影响

German Garrido-Lestache Belinchon, Hugo Garrido-Lestache Belinchon

专题命中 长文档RAG :retrieval-augmented generation(title,abstract);RAG(abstract,abstract_cn);分类 cs.IR、cs.CL、cs.AI

AI总结 研究文本块大小对检索增强生成性能的影响,评估其与检索段数量如何影响生成质量和检索效果,通过比较配置,以更好理解文档分割对检索增强生成系统性能和效率的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24760 2026-07-29 cs.IR 新提交 77%

CHaystack: Benchmarking Chinese Document Retrieval and VQA

CHaystack:中文文档检索与视觉问答基准测试

Hanxi Li

专题命中 长文档RAG :RAG(abstract,abstract_cn);retrieval-augmented generation(abstract);分类 cs.IR

AI总结 本文介绍了CHaystack中文文档检索与视觉问答基准测试,涵盖四类文档。提出CDocRAG系统,用VLM相关性过滤器验证文档图像。评估开源模型发现Qwen系列在文本丰富文档表现佳,中文大规模DocumentVQA在文本编码方面有挑战,仍需改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05811 2026-07-29 cs.AI 版本更新 57%

Sheet As Token: A Graph-Enhanced Representation for Multi-Sheet Spreadsheet Understanding

表格作为标记:一种增强图的多表表格理解表示

Yiming Lei, Yuhang Yao, Yujia Zhang, Yiqi Wang, Bo Guan, Depei Zhu, Chunhui Wang, Zhuonan Hao, Tianyu Shi

机构 * Effyic Technology Co., Ltd(Effyic技术有限公司) McGill University(麦吉尔大学)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 本文提出Sheet as Token框架,通过图增强方法将每个工作表视为统一语义单元,提升多表表格检索能力,实验表明图增强的跨表推理在有限计算下优于浅层图基线。

详情

展开后加载摘要…

URL PDF HTML 收藏