arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-06-15 至 2026-06-15 共收录 13 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 8 篇

2606.06794 2026-06-15 cs.CL cs.IR 新提交 93%

TA-RAG: Tone-Aware Retrieval-Augmented Generation for Peer-Support Health Communication

TA-RAG: 面向同伴支持健康沟通的语气感知检索增强生成

Yong-Bin Kang, Anthony McCosker

机构 * Swinburne University of Technology(斯winburne大学)

专题命中 检索器与排序 :RAG(title,title_cn);retrieval-augmented generation(title,abstract);分类 cs.IR、cs.CL

AI总结 提出TA-RAG框架,通过轻量级提示在RAG管道中嵌入语气控制(无污名化、可读性调整、受众适应、同理心改写),无需微调模型,提升敏感健康沟通质量。

Comments 5 pages, 5 figures, CIKM 2026 submission manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00865 2026-06-15 cs.IR 版本更新 92%

Doctor-RAG: A Failure-Aware Repair Framework for Agentic Retrieval-Augmented Generation

Doctor-RAG:面向智能检索增强生成的故障感知修复框架

Shuguang Jiao, Chengkai Huang, Shuhan Qi, Xuan Wang, Yifan Li, Quanchi Weng, Lingchuan Liu, Xunliang Cai, Lina Yao

专题命中 检索器与排序 :RAG(title,title_cn);retrieval-augmented generation(title,abstract);分类 cs.IR

AI总结 提出Doctor-RAG框架,通过显式错误定位和前缀复用,在智能RAG中实现高效诊断与局部修复,显著提升多跳问答准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20734 2026-06-15 cs.CL cs.AI cs.CV cs.IR cs.LG 版本更新 87%

UniversalRAG: Retrieval-Augmented Generation over Corpora of Diverse Modalities and Granularities

UniversalRAG: 在多样模态和粒度的语料库上实现检索增强生成

Woongyeong Yeo, Kangsan Kim, Soyeong Jeong, Jinheon Baek, Sung Ju Hwang

机构 * KAIST(韩国科学技术院)

专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);RAG(abstract,abstract_cn);分类 cs.IR、cs.CL、cs.AI

AI总结 本文提出UniversalRAG,一种能够处理多种模态和粒度的检索增强生成框架,通过动态路由机制和多粒度组织,提升跨模态知识检索的有效性,实验表明其在多个模态基准上的优越性。

Comments ACL 2026. Project page : https://universalrag.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14269 2026-06-15 cs.IR cs.CL 新提交 76%

ScoreGate: Adaptive Chunk Selection for Retrieval-Augmented Generation via Dual-Score Statistical Fusion

ScoreGate: 通过双分数统计融合实现检索增强生成的自适应分块选择

Karamvir Singh, Arvind Jain

机构 * HighLevel, Inc.(HighLevel公司)

专题命中 检索器与排序 :retrieval-augmented generation(title);分类 cs.IR、cs.CL

AI总结 针对固定K检索导致过检索或欠检索的问题,提出ScoreGate,利用双编码器相似度和交叉编码器重排序分数进行自适应检索数量控制,无需额外模型调用,在MS MARCO上以更少块数提升MRR@10,并实现零假阳性。

Comments 20 pages, 6 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13905 2026-06-15 cs.IR cs.CL 新提交 62%

ADORE: Iterative Query Expansion with Retrieval-Grounded Relevance Feedback

ADORE: 基于检索反馈的迭代查询扩展

Amin Bigdeli, Negar Arabzadeh, Radin Hamidi Rad, Sajad Ebrahimi, Charles L. A. Clarke, Ebrahim Bagheri

机构 * University of Waterloo(滑铁卢大学) Mila – Quebec AI Institute(魁北克人工智能研究所) University of Toronto(多伦多大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.CL

AI总结 提出ADORE框架,通过迭代生成伪段落、检索语料库并评估相关性,利用检索反馈指导查询扩展,显著提升检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23336 2026-06-15 cs.IR cs.CL cs.LG 版本更新 62%

Efficient Rationale-based Retrieval: On-policy Distillation from Generative Rerankers based on JEPA

高效基于理由的检索:基于JEPA的生成重排序器的在线蒸馏

Teng Chen, Sheng Xu, Feixiang Guo, Xiaoyu Wang, Qingqing Gu, Hongyan Li, Luo Ji

机构 * Geely AI Lab(吉利人工智能实验室)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.CL

AI总结 本文提出Rabtriever,通过在线蒸馏从生成重排序器中学习,将查询和文档独立编码,提升检索效率,同时在多个任务中表现优异。

Comments 11 pages, 8 figures. ICMR 2026 (https://youtu.be/apDcrzEVwq4)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14474 2026-06-15 cs.IR cs.HC 新提交 57%

Verifiable User Simulation for Search and Recommendation Systems

面向搜索与推荐系统的可验证用户模拟

Chenglong Ma, Xinye Wanyan, Danula Hettiachchi, Ziqi Xu, Yongli Ren, Jeffrey Chan

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.IR

AI总结 提出一个七组件可审计框架,将用户模拟器视为可验证工程制品,通过动手实验检查模拟器行为、诊断差异并检测人口偏差。

Comments Presented as a half-day tutorial at SIGIR 2026, 4 pages

Journal ref In Proceedings of the 49th International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14243 2026-06-15 cs.CL 新提交 57%

Decoupled Mixture-of-Experts for Parametric Knowledge Injection

解耦混合专家用于参数化知识注入

Baoqing Yue, Weihang Su, Qingyao Ai, Yichen Tang, Changyue Wang, Jiacheng Kang, Jingtao Zhan, Yiqun Liu

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 提出解耦混合专家(DMoE)架构,将外部知识转化为独立可更新的专家模块,通过轻量级不确定性感知路由器在基础模型知识不足时激活相关专家,实现参数级知识增强,在知识密集型基准上优于检索和适配器基线。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 知识库问答 1 篇

2601.11273 2026-06-15 cs.IR 版本更新 90%

Rank4Gen: RAG-Preference-Aligned Document Set Selection and Ranking

Rank4Gen:RAG偏好对齐的文档集选择与排序

Yongqi Fan, Yuxiang Chu, Zhentao Xia, Xiaoyang Chen, Jie Liu, Haijin Liang, Jin Ma, Ben He, Yingfei Sun, Jie Zhai, Dezhi Ye, Tong Ruan

专题命中 知识库问答 :RAG(title,title_cn);分类 cs.IR

AI总结 针对RAG中下游生成器对文档组合和排序的偏好差异,提出PRISM数据集和Rank4Gen排序器,通过联合文档集选择与排序提升下游QA质量。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 长文档RAG 1 篇

2505.23277 2026-06-15 cs.CL cs.AI 版本更新 79%

Sentinel: Decoding Context Utilization via Attention Probing for Efficient LLM Context Compression

Sentinel: 通过注意力探测解码上下文利用以实现高效LLM上下文压缩

Yong Zhang, Heng Li, Yanwen Huang, Ning Cheng, Yang Guo, Yun Zhu, Yanmeng Wang, Shaojun Wang, Jing Xiao

机构 * Ping An Technology (Shenzhen) Co., Ltd., China(平安科技(深圳)有限公司,中国) University of Science and Technology of China(中国科学技术大学) University of Electronic Science and Technology of China(电子科技大学)

专题命中 长文档RAG :RAG(abstract,abstract_cn);retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 提出Sentinel,一种轻量级句子级压缩框架,通过冻结LLM的头部注意力模式解码推理时上下文利用行为,使用单次非自回归前向传递实现压缩,在LongBench上以0.5B代理模型达到5倍压缩且性能与7B模型方法相当。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图谱与结构化RAG 1 篇

2606.14275 2026-06-15 cs.DB 新提交 70%

WikiKV: Schema-Evolving Path-Indexed Storage for Hierarchical Knowledge Navigation

WikiKV: 面向层次知识导航的架构演化路径索引存储

Feifei Li, Haoliang Ming, Zihan Li, Hang Liao, Xingyu Fan, Xiaoqing Wu, Chenggong Wang, Wenhui Que

专题命中 图谱与结构化RAG :RAG(abstract,abstract_cn);分类 cs.DB

AI总结 提出WikiKV,一种专为LLM策展层次知识库设计的路径索引键值存储模型,通过数据驱动架构、一致性协议和预算导航算子,实现低延迟查询和渐进式答案优化。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

5. RAG评测 2 篇

2606.14119 2026-06-15 cs.AI 新提交 84%

FactoryLLM: A Safe and Open-Source AI Playground for Evaluating LLMs in Smart Factories

FactoryLLM:用于评估智能工厂中大语言模型的安全开源AI实验场

Yash Pulse, Yong-Bin Kang, Abhik Banerjee, Abdur Forkan, Prem Prakash Jayaraman

专题命中 RAG评测 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.AI

AI总结 提出FactoryLLM,一个安全开源的AI实验场,通过多机器文档分析评估基于RAG的大语言模型,采用RAGAS和NVIDIA LLM-as-a-Judge双评估机制,案例验证了跨机器文档推理的有效性。

Comments 6 pages, 3 figures, IEEE INDIN 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13756 2026-06-15 cs.CL 新提交 57%

QIAS 2026: Overview of the Shared Task on Islamic Inheritance Reasoning

QIAS 2026:伊斯兰继承推理共享任务综述

Abdessalam Bouchekif, Somaya Eltanbouly, Samer Rashwani, Shahd Gaben, Mutaz Al-Khatib, Heba Sbahi, Emad Mohamed, Mohammed Ghaly

机构 * Hamad bin Khalifa University(哈马德·本·哈利法大学) Nazarbayev University(纳扎尔巴耶夫大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文介绍 QIAS 2026 共享任务,评估大语言模型在伊斯兰继承领域的复杂推理能力,基于 MAWARITH 数据集,使用 MIR-E 多步指标评估,16 支队伍参与,结果显示该任务对当前模型极具挑战性。

详情

展开后加载摘要…

URL PDF HTML 收藏