arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-08-21 至 2026-08-21 共收录 11 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 6 篇

2608.19526 2026-08-21 cs.CL cs.AI cs.IR 新提交 90%

Automated Summarization of Financial News Using Large Language Models and Retrieval-Augmented Generation: An Early Empirical Study (Fall 2023)

基于大语言模型与检索增强生成的财经新闻自动摘要:2023年秋的早期实证研究

Pranav Chandaliya

机构 * George Washington University(乔治·华盛顿大学)

专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);RAG(summary_cn,abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 该2023年秋的研究构建了结合LLM与RAG的财经新闻摘要流程,测试多种模型与方法,发现Summarize Chains的Falcon-7B表现最优,RAG存在缺陷,且相关失效模式至今仍具参考价值。

Comments 17 pages, 1 figure, 6 tables. Research conducted Fall 2023 at George Washington University; manuscript prepared for public release in 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20097 2026-08-21 cs.CR cs.DC 新提交 88%

TrustRAG: Blockchain-Enhanced RAG via Committee-Based Credibility Scoring

TrustRAG:基于区块链的检索增强生成系统,通过委员会机制实现可信度评分

Baixiang Liu, Haotian Che, Yuan Li

专题命中 检索器与排序 :RAG(title,summary_cn);retrieval-augmented generation(abstract)

AI总结 针对RAG系统难以验证文档可信度的问题,提出TrustRAG,结合区块链与委员会机制,通过零知识协议、安全多方计算及哈希承诺实现可验证的文档信任评分,保障关键领域决策安全。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20246 2026-08-21 cs.IR 新提交 85%

What Makes a Good Fiqh Retriever? Answer Retrieval for Arabic Islamic Jurisprudence

什么样的伊斯兰教法检索器是优秀的?阿拉伯伊斯兰教法的答案检索

Somaya Eltanbouly, Heba Sbahi, Samer Rashwani, Abdessalam Bouchekif, Mutaz al-Khatib, Shahd Gaben, Mohammed Ghaly

专题命中 检索器与排序 :retriever(title,abstract);retrieval-augmented generation(abstract);hybrid retrieval(abstract);分类 cs.IR

AI总结 本研究针对阿拉伯伊斯兰教法构建检索测试集,评估多种检索策略,发现教法学派感知过滤可显著提升教派特定问题的检索性能,核心挑战是区分答案承载与主题相似的非答案段落。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19998 2026-08-21 cs.IR 新提交 79%

SCoRD: Semantic-Assisted Continual Retriever-Reranker Distillation for LLM-Based Recommendation

SCoRD:用于基于大语言模型(LLM)推荐的语义辅助持续检索-重排序蒸馏

Seunghyun Baek, Gyuseok Lee, Seunghan Lee, Wonbin Kweon, Dong Wang, SeongKu Kang

专题命中 检索器与排序 :retriever(title,abstract);分类 cs.IR

AI总结 SCoRD是面向非平稳数据流的LLM推荐两阶段流程的持续知识蒸馏框架,通过语义推理助手实现检索器与重排序器的高效协同适配,在真实数据集上验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19595 2026-08-21 cs.IR 新提交 79%

SSR-GRPO: Integrating Supervision and Semantic IDs into Reinforcement Learning for Dense Retrieval in E-commerce

SSR-GRPO:将监督与语义标识符集成到强化学习中用于电商领域的密集检索

Guangxin Song, Xing Fang, Mingmin Jin, Jing Wang, Bokang Wang, Zhentao Song, Junjie Bai, Jianbo Zhu

专题命中 检索器与排序 :dense retrieval(title,abstract);分类 cs.IR

AI总结 该研究针对电商嵌入检索的语义处理难题,提出SSR-GRPO模型,通过双视角相关性评估、难负样本挖掘等策略优化R-GRPO,经实验验证有效并已部署于大规模电商平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20317 2026-08-21 cs.IR 新提交 57%

Projecting BrowseComp-Plus onto ClimbMix: Toward More Realistic Corpora for Agentic Search

将BrowseComp-Plus映射到ClimbMix:构建更符合智能体搜索需求的真实语料库

Sahel Sharifymoghaddam, Lingwei Gu, Yijun Ge, Jimmy Lin

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 该研究将BrowseComp-Plus的查询映射到NVIDIA的ClimbMix语料库,构建了与基准无关的映射流水线,生成57个有效查询,使智能体搜索难度向检索环节转移,发布了相关资源。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 长文档RAG 2 篇

2608.19535 2026-08-21 cs.AI cs.CL cs.DC cs.IR cs.PF 新提交 91%

From Retrieved Context to Runtime Control: Adaptive Compression for Edge-based RAG

从检索上下文到运行时控制:基于边缘设备的检索增强生成(RAG)的自适应压缩

Zlatan Feric, Amir Taherin, Yanzhi Wang, David Kaeli

机构 * Northeastern University(东北大学)

专题命中 长文档RAG :RAG(title,title_cn);retrieval-augmented generation(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 该研究针对边缘RAG的上下文压缩问题,提出遥测驱动的自适应压缩方案,通过实验发现中等压缩可显著降低能耗且质量损失极小,主张基于工作负载和边缘遥测动态管理压缩。

Comments Accepted to appear in the Proceedings of the ACM AI Leadership Summit 2026. Zlatan Feric and Amir Taherin contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19199 2026-08-21 cs.CL cs.AI cs.IR 新提交 83%

A Virtual Member of a Community of Practice for the Society of Petroleum Engineers: From Prototype to Deployment

石油工程师协会实践社区的虚拟成员:从原型到部署

John Boden, Joshua Eckroth, Dayne Freitag, Skyler Gipson, Johnathan Keefe, Karen Myers, Eric Schoen, Pedro Sequeira, Reid Smith, Michael Wessel

专题命中 长文档RAG :RAG(summary_cn,abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 本文介绍了面向SPE石油天然气领域实践社区的虚拟助手ATHENA,经迭代优化后,其在井规划知识任务中优于RAG基线,已整合至SPE研究门户并部署使用。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 图谱与结构化RAG 1 篇

2608.19235 2026-08-21 cs.DL 新提交 75%

Beyond Document Retrieval: Architectural Challenges When LLM Agents Query Structured Enterprise Data

超越文档检索:LLM智能体查询结构化企业数据时的架构挑战

Sheikh Nazib Ahmed

专题命中 图谱与结构化RAG :RAG(abstract,abstract_cn);retrieval-augmented generation(abstract)

AI总结 该研究针对企业智能体查询结构化数据的架构挑战,划分七个维度提出设计框架,经实验验证其可消除授权违规,还给出评估协议与开放问题。

Comments 9 pages, 4 tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 多模态RAG 1 篇

2608.19218 2026-08-21 cs.CL cs.AI cs.LG 新提交 73%

Time-Series Retrieval for Grounding Multimodal Language Models in Remaining Useful Life

用于将多模态语言模型与剩余使用寿命关联的时间序列检索

Valeriu Dimidov, Raphaël Frank

机构 * University of Luxembourg(卢森堡大学)

专题命中 多模态RAG :RAG(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 本文提出时间序列检索关联的多模态大语言模型框架,在C-MAPSS基准FD001分区实验显示,该方法可提升RUL预测的误差与稳定性,且效果随模型容量变化。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. RAG评测 1 篇

2608.19509 2026-08-21 cs.SE 新提交 88%

An Agentic RAG and Evaluation Framework for Assurance Case Generation: Industrial Use Case for the EU Cyber Resilience Act Compliance

用于保障案例生成的智能检索增强生成与评估框架:欧盟网络弹性法案合规性的工业用例

Fariz Ikhwantri, Iker Lasa Ojanguren, Dusica Marijan, Maria I. Maslioukova, José Arias Marin, Pavlos Kosmides

专题命中 RAG评测 :RAG(title,summary_cn);retrieval-augmented generation(abstract)

AI总结 该研究提出基于智能RAG的保障案例生成与评估框架,通过案例研究验证其可自动化欧盟网络弹性法案合规评定,减少人工并提升证据可追溯性。

Comments 6 pages, accepted at ISSRE 2026 (Industry track)

详情

展开后加载摘要…

URL PDF HTML 收藏