arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-03-25 至 2026-03-25 共收录 12 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 12 篇

2603.22340 2026-03-25 cs.IR cs.AI 88%

Graphs RAG at Scale: Beyond Retrieval-Augmented Generation With Labeled Property Graphs and Resource Description Framework for Complex and Unknown Search Spaces

大规模图RAG:通过标记属性图和资源描述框架超越检索增强生成

Manie Tadayon, Mayank Gupta

机构 * Capital Group(资本集团)

专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);RAG(title,abstract);分类 cs.IR、cs.AI

AI总结 本文提出了一种端到端的图RAG框架,利用标记属性图和资源描述框架解决传统RAG在未知搜索空间和半结构化数据中的局限,提升准确性和查询生成效率。

Comments 17 pages, 4 figures, 35 citations/references

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22633 2026-03-25 cs.AI cs.IR 86%

Graph-Aware Late Chunking for Retrieval-Augmented Generation in Biomedical Literature

面向生物医学文献的图感知后期分块检索增强生成

Pouria Mortezaagha, Arya Rahgozar

机构 * Methodological Implementation Research, Ottawa Hospital Research Institute(方法学实施研究,渥太华医院研究所在职) School of Engineering Design and Teaching Innovation, University of Ottawa(工程设计与教学创新学院,渥太华大学)

专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);RAG(abstract);hybrid retrieval(abstract);分类 cs.IR、cs.AI

AI总结 本文提出GraLC-RAG框架,结合图感知结构智能与后期分块技术,通过结构感知分块、UMLS知识图谱融合和图引导混合检索,提升生物医学文献多部分信息检索与生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17908 2026-03-25 cs.CL cs.AI cs.IR 85%

Principled Context Engineering for RAG: Statistical Guarantees via Conformal Prediction

基于RAG的原理化上下文工程:通过符合预测实现统计保证

Debashish Chakraborty, Eugene Yang, Daniel Khashabi, Dawn Lawrie, Kevin Duh

机构 * HLTCOE, Johns Hopkins University(HLTCOE,约翰霍普金斯大学)

专题命中 检索器与排序 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 本文提出通过符合预测框架实现RAG的上下文工程,通过统计可控的过滤方法减少冗余上下文,提升事实准确性。

Comments Accepted at ECIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23353 2026-03-25 cs.HC 82%

Design Space and Implementation of RAG-Based Avatars for Virtual Archaeology

基于RAG的虚拟考古中 avatars 的设计空间与实现

Wilhelm Kerle-Malcharek, Giulio Biondi, Karsten Klein, Ulf Hailer, Steffen Diefenbach, Fabrizio Grosso, Marco Legittimo, Paola Venuti, Carla Binucci, Giuseppe Liotta, Falk Schreiber

专题命中 检索器与排序 :RAG(title,abstract);retrieval-augmented generation(abstract)

AI总结 本文探讨了基于RAG的avatrs在虚拟考古中的应用,设计了涵盖应用场景、avatrs个性及输入输出模式的需求空间,并通过虚拟现实环境中的案例研究验证了其在提升数字文化遗产互动性方面的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23049 2026-03-25 cs.DC 82%

PCR: A Prefetch-Enhanced Cache Reuse System for Low-Latency RAG Serving

PCR:一种增强预取的缓存重用系统,用于低延迟RAG服务

Wenfeng Wang, Xiaofeng Hou, Peng Tang, Hengyi Zhou, Jing Wang, Xinkai Wang, Chao Li, Minyi Guo

专题命中 检索器与排序 :RAG(title,abstract);retrieval-augmented generation(abstract)

AI总结 PCR通过智能预取和流水线数据传输技术,提升RAG服务中KV缓存重用效率,降低TTFT延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04951 2026-03-25 cs.AI 79%

Retrieval-Augmented Generation with Covariate Time Series

增强检索生成与协变量时间序列

Kenny Ye Liang, Zhongyi Pei, Huan Zhang, Yuhui Liu, Shaoxu Song, Jianmin Wang

机构 * Tsinghua University(清华大学)

专题命中 检索器与排序 :retrieval-augmented generation(title);RAG(abstract);分类 cs.AI

AI总结 本文提出RAG4CTS框架,解决时间序列基础模型在数据稀缺、短暂序列和协变量耦合动态下的预测问题,通过层级时间序列知识库和双阶段加权检索机制提升预测精度。

Comments 12 pages. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22856 2026-03-25 eess.IV 67%

Retrieval-Guided Photovoltaic Inventory Estimation from Satellite Imagery for Distribution Grid Planning

基于卫星图像的检索引导光伏库存估计用于配电网规划

Muhao Guo, Lihao Mai, Erik Blasch, Jafarali Parol, Turki Rakan, Yang Weng

专题命中 检索器与排序 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文提出Solar-RAG框架,通过图像检索与多模态视觉语言推理结合,提升光伏部署估计的鲁棒性,减少配电网规划中的电压偏差和承载能力误差。

Comments 38 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04348 2026-03-25 cs.CV cs.AI 57%

RANGER: Sparsely-Gated Mixture-of-Experts with Adaptive Retrieval Re-ranking for Pathology Report Generation

RANGER: 用于病理报告生成的稀疏门控专家混合模型与自适应检索重排序

Yixin Chen, Ziyu Su, Hikmat Khan, Muhammad Khalid Khan Niazi

机构 * Department of Biomedical Engineering, The Ohio State University(生物医学工程系,俄亥俄州立大学) Department of Pathology, The Ohio State University(病理学系,俄亥俄州立大学)

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI

AI总结 RANGER通过稀疏门控专家混合模型和自适应检索重排序,提升病理报告生成的生成特化与语义对齐,实验表明在PathText-BRCA数据集上性能优于现有方法。

Journal ref Proceedings of the IEEE/CVF CVPR 2026 Workshops (CV4Clinical)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23013 2026-03-25 cs.CL 57%

Knowledge Access Beats Model Size: Memory Augmented Routing for Persistent AI Agents

知识访问胜过模型规模:基于对话记忆的持久AI代理路由

Xunzhuo Liu, Bowei He, Xue Liu, Andy Luo, Haichen Zhang, Huamin Chen

机构 * vLLM Semantic Router Project(vLLM语义路由器项目) MBZUAI McGill University(麦吉尔大学) Mila AMD Red Hat(红帽)

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.CL

AI总结 本文提出利用对话记忆提升AI代理效率,通过轻量模型结合检索信息,使小模型在用户特定查询中表现优于大模型,证明知识访问比模型规模更重要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22943 2026-03-25 cs.AI 57%

PersonalQ: Select, Quantize, and Serve Personalized Diffusion Models for Efficient Inference

PersonalQ: 选择、量化并服务个性化扩散模型以实现高效推理

Qirui Wang, Qi Guo, Yiding Sun, Junkai Yang, Dongxu Zhang, Shanmin Pang, Qing Guo

机构 * School of Software Engineering, Xi'an Jiaotong University(西安交通大学软件工程学院) Nankai University(南开大学)

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.AI

AI总结 PersonalQ通过触发令牌连接检查点选择与量化,提升意图对齐并优化压缩质量,实现高效个性化扩散模型服务。

Comments Accepted in ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22815 2026-03-25 cs.CV 50%

Captain Safari: A World Engine with Pose-Aligned 3D Memory

Captain Safari: 一种具有姿态对齐3D记忆的世界引擎

Yu-Cheng Chou, Xingrui Wang, Yitong Li, Jiahao Wang, Hanting Liu, Cihang Xie, Alan Yuille, Junfei Xiao

机构 * Johns Hopkins University(约翰霍普金斯大学) Tsinghua University(清华大学) UC Santa Cruz(加州大学圣克ruz分校)

专题命中 检索器与排序 :retriever(abstract)

AI总结 本文提出Captain Safari,一种基于姿态条件的世界引擎,通过持久化世界记忆生成视频,提升了复杂场景下的3D一致性与轨迹跟踪能力,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15620 2026-03-25 cs.LG 50%

On-device Semantic Selection Made Low Latency and Memory Efficient with Monolithic Forwarding

在设备上实现语义选择:通过单体转发实现低延迟和内存高效

Jiahao Zhou, Chengliang Lin, Dingji Li, Mingkai Dong, Haibo Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Huawei(华为)

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 本文提出PRISM系统,通过单体转发实现低延迟和内存高效的语义top-K选择,减少延迟和内存使用,提升设备AI应用的效率和部署性。

详情

展开后加载摘要…

URL PDF HTML 收藏