arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-06-23 至 2026-06-23 共收录 5 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 长文档RAG 5 篇

2606.20898 2026-06-23 cs.IR cs.AI cs.CL cs.CY 新提交 91%

The Token Tax of Epistemic Accuracy: Comparing RAG and Long-Context Architectures for Document-Grounded Generative AI Applications

认知准确性的Token税:比较RAG与长上下文架构在文档基础生成式AI应用中的表现

Austin Hamilton, Ryan Singh, Michael Wise, Ibrahim Yousif, Arthur Carvalho, Zhe Shan, Mohammad Mayyas, Lora A. Cavuoto, Fadel M. Megahed

机构 * Miami University(迈阿密大学) University at Buffalo(布法罗大学)

专题命中 长文档RAG :RAG(title,title_cn);retrieval-augmented generation(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 研究比较RAG与长上下文提示两种架构在文档基础生成式AI中的认知准确性与成本权衡,发现长上下文虽准确率更高(73.1% vs 65.4%),但Token成本增加26倍。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22681 2026-06-23 cs.CL cs.AI 新提交 91%

Only Ask What You Don't Know: Grounded Delta Planning for Efficient Multi-step RAG

只问你不知道的:基于接地增量规划的高效多步RAG

Wei-Chieh Chou, Xuanjun Chen, Jian-Ren Lin, Claire Lin, Hung-yi Lee, Jyh-Shing Roger Jang

机构 * Dept. of Computer Science and Information Engineering, National Taiwan University(国立台湾大学资讯工程学系) Graduate Institute of Communication Engineering, National Taiwan University(国立台湾大学电信工程学研究所) Department of Economics, National Taiwan University(国立台湾大学经济学系) Department of Information Management, National Taiwan University(国立台湾大学资讯管理学系) NTU Artificial Intelligence Center of Research Excellence (NTU AI-CoRE)(国立台湾大学人工智能卓越研究中心)

专题命中 长文档RAG :RAG(title,title_cn);retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 提出GDP-RAG框架,通过初步检索、缺口条件规划和骨架轨迹,仅针对信息增量进行推理,在HotpotQA等数据集上以最低成本实现最高准确率。

Comments Submitted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21842 2026-06-23 cs.CR 新提交 88%

Agent-Assisted Side-Channel Attacks on Non-Prefix KV Cache in RAG

代理辅助的非前缀KV缓存侧信道攻击

He Sun, Shinan Liu, Siyuan Ma, Junhao Li, Mingjun Xiao, Wenhao Jiang

专题命中 长文档RAG :RAG(title,summary_cn);retrieval-augmented generation(abstract)

AI总结 针对RAG系统中非前缀KV缓存融合的侧信道漏洞,提出SpliceLeak攻击,利用“阶梯波”时序特征提取私有提示长度和语义内容,并设计SpliceDefense防御机制。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23108 2026-06-23 cs.AI 新提交 70%

TTFT-Aware Graph Chain-of-Thought:Distance-Indexed Neural A* for Low-Hallucination Multi-Hop Medical Reasoning

TTFT感知的图链式思维:用于低幻觉多跳医学推理的距离索引神经A*

Bechir Dardouri, Kaïs Zhioua, Yassine Msaddak

机构 * Tanit Healthcare Technologies, Tunisia(突尼斯塔尼特医疗技术公司)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 提出一种生产级GraphRAG框架,通过距离索引的神经A*算法在医学知识图谱中导航,结合PLL精确距离和AStarNet启发式,实现低延迟、低幻觉的多跳推理,并改善首令牌时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22963 2026-06-23 cs.CR cs.AI 版本更新 70%

When Compression Becomes an Attack Surface: Black-Box Attacks on Prompt-Compressed LLM Agents

当压缩成为攻击面:针对提示压缩的LLM智能体的黑盒攻击

Zesen Liu, Zhixiang Zhang, Yuchong Xie, Dongdong She

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 提出当可信与不可信输入共享压缩预算时,攻击者可通过扰动不可信输入导致压缩器丢弃关键证据或安全护栏,并设计黑盒攻击COMA,平均攻击成功率达0.71。

详情

展开后加载摘要…

URL PDF HTML 收藏