arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-04-10 至 2026-04-10 共收录 11 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 11 篇

2604.07403 2026-04-10 cs.CR 85%

RefineRAG: Word-Level Poisoning Attacks via Retriever-Guided Text Refinement

RefineRAG:通过检索引导的文本细化实现词级污染攻击

Ziye Wang, Guanyu Wang, Kailong Wang

专题命中 检索器与排序 :retriever(title,abstract);retrieval-augmented generation(abstract);RAG(abstract)

AI总结 RefineRAG通过检索引导的文本细化方法,解决传统污染攻击检测不足的问题,实现高成功率的词级污染攻击,同时保持自然性和低语法错误。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19280 2026-04-10 cs.LG cs.DC cs.IR 83%

Efficient Federated Search for Retrieval-Augmented Generation using Lightweight Routing

高效联邦搜索用于检索增强生成:使用轻量级路由

Akash Dhasade, Rachid Guerraoui, Anne-Marie Kermarrec, Diana Petrescu, Rafael Pires, Mathis Randl, Martijn de Vos

机构 * EPFL(瑞士联邦理工学院洛桑分校)

专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);RAG(abstract);分类 cs.IR

AI总结 本文提出RAGRoute,一种轻量级路由机制,通过神经分类器动态选择相关数据源,减少通信开销和端到端延迟,同时保持检索质量,在三个基准测试中实现通信量减少80.65%和延迟减少52.50%。

Comments To appear in the proceedings of DAIS 2026 (Distributed Applications and Interoperable Systems). An earlier version appeared at EuroMLSys 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11548 2026-04-10 cs.CR cs.AI 83%

One Shot Dominance: Knowledge Poisoning Attack on Retrieval-Augmented Generation Systems

单文档支配:面向检索增强生成系统的知识污染攻击

Zhiyuan Chang, Mingyang Li, Xiaojun Jia, Junjie Wang, Yuekai Huang, Ziyou Jiang, Yang Liu, Qing Wang

机构 * State Key Laboratory of Intelligent Game(智能游戏国家重点实验室) Science and Technology on Integrated Information System Laboratory, Institute of Software Chinese Academy of Sciences(中国科学院软件研究所综合信息系统技术国家级重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Nanyang Technological University(南洋理工大学)

专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);RAG(abstract);分类 cs.AI

AI总结 本文提出AuthChain攻击方法,通过单文档污染实现对检索增强生成系统更有效的知识污染攻击,提升攻击成功率并保持隐蔽性。

Comments 15pages, 4 figures; accepted by EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07816 2026-04-10 cs.CL 79%

Tool Retrieval Bridge: Aligning Vague Instructions with Retriever Preferences via Bridge Model

工具检索桥:通过桥模型对模糊指令与检索器偏好进行对齐

Kunfeng Chen, Luyao Zhuang, Fei Liao, Juhua Liu, Jian Wang, Bo Du

机构 * Department of Gastroenterology, Renmin Hospital, Wuhan University(武汉大学人民医院消化内科) School of Computer Science, Wuhan University(武汉大学计算机学院) State Grid Corporation(国家电网公司)

专题命中 检索器与排序 :retriever(title,abstract);分类 cs.CL

AI总结 本文提出TRB方法,通过桥模型将模糊指令转化为更具体的指令,提升模糊指令下的工具检索性能,实验表明TRB在多个检索设置下显著提升检索效果。

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07419 2026-04-10 cs.IR 79%

ReAlign: Optimizing the Visual Document Retriever with Reasoning-Guided Fine-Grained Alignment

ReAlign:通过推理引导的细粒度对齐优化视觉文档检索

Hao Yang, Yifan Ji, Zhipeng Xu, Zhenghao Liu, Yukun Yan, Zulong Chen, Shuo Wang, Yu Gu, Ge Yu

专题命中 检索器与排序 :retriever(title,abstract);分类 cs.IR

AI总结 本文提出ReAlign方法,利用VLM推理能力生成细粒度视觉描述作为监督信号,提升视觉文档检索性能,实验表明在不同领域数据集上均取得2%的相对提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07659 2026-04-10 cs.CL 70%

Efficient and Effective Internal Memory Retrieval for LLM-Based Healthcare Prediction

高效且有效的内部内存检索用于基于大语言模型的医疗预测

Mingchen Li, Jiatan Huang, Zonghai Yao, Hong yu

机构 * University of Connecticut(康涅狄格大学) University of Massachusetts, Amherst(马萨诸塞大学阿默斯特分校) University of Massachusetts, Lowell(马萨诸塞大学洛厄尔分校) UMass Chan Medical School(马萨诸塞大学陈医学院)

专题命中 检索器与排序 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

AI总结 本文提出K2K框架,通过内部键基知识访问提升LLM在医疗预测中的效率与准确性,实验显示在四个基准数据集上达到最佳性能。

Comments ACL 2026 (Findings), reviewer score: 3.5,3.5,4

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07863 2026-04-10 cs.IR cs.AI 62%

Task-Adaptive Retrieval over Agentic Multi-Modal Web Histories via Learned Graph Memory

基于学习图记忆的代理多模态网络历史任务自适应检索

Saman Forouzandeh, Kamal Berahmand, Mahdi Jalili

机构 * School of Engineering, Royal Melbourne Institute of Technology University(皇家墨尔本理工大学工程学院)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.AI

AI总结 本文提出ACGM方法,通过任务自适应图记忆检索代理历史,利用策略梯度优化提升检索质量,在多个数据集上取得显著成果。

Comments The 49th International ACM SIGIR Conference on Research and Development in Information Retrieval

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08605 2026-04-10 cs.CL cs.CY cs.HC cs.MA cs.MM 57%

Mina: A Multilingual LLM-Powered Legal Assistant Agent for Bangladesh for Empowering Access to Justice

Mina:一种多语言大语言模型驱动的法律助理代理,用于孟加拉国,以促进获得正义

Azmine Toushik Wasi, Wahid Faisal, Mst Rafia Islam, Md Rizwan Parvez

专题命中 检索器与排序 :RAG(abstract);分类 cs.CL

AI总结 Mina通过多语言嵌入和基于RAG的工具链框架,为孟加拉国提供多语言法律助理服务,实现法律文书、引文和通俗解释的生成,经评估在法律考试中表现优异,成本显著降低。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07900 2026-04-10 cs.CV cs.AI 57%

AnomalyAgent: Agentic Industrial Anomaly Synthesis via Tool-Augmented Reinforcement Learning

AnomalyAgent:通过工具增强强化学习进行代理工业异常合成

Jiaming Su, Tengchao Yang, Ruikang Zhang, Zhengan Yan, Haoyu Sun, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Tongji University(同济大学) Fudan University(复旦大学)

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI

AI总结 本文提出AnomalyAgent,通过工具增强强化学习生成高语义真实性的工业异常样本,采用闭环优化和两阶段训练框架,实现自我反思与迭代改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07645 2026-04-10 cs.AI 57%

PRIME: Training Free Proactive Reasoning via Iterative Memory Evolution for User-Centric Agent

PRIME:通过迭代记忆进化实现无梯度的前瞻性推理以构建以用户为中心的智能体

Prince Zizhuang Wang, Shuli Jiang

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 PRIME通过迭代记忆进化框架,实现无梯度学习,使智能体在多轮人机交互中高效学习用户意图,提升任务执行效率和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02781 2026-04-10 cs.LG cs.AI 57%

An Automated Survey of Generative Artificial Intelligence: Large Language Models, Architectures, Protocols, and Applications

生成人工智能的自动化调查:大型语言模型、架构、协议和应用

Eduardo C. Garrido-Merchán, Álvaro López López

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 本文调查了生成人工智能领域,重点分析了前沿大型语言模型的架构、训练方法和性能,涵盖多个模型家族及部署协议,总结了各行业应用案例。

详情

展开后加载摘要…

URL PDF HTML 收藏