Lexically-Accelerated Dense Retrieval
专题命中 检索器与排序 :dense retrieval(title,abstract);retriever(abstract);分类 cs.IR、cs.CL
Comments SIGIR 2023
AI 大模型
检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。
专题命中 检索器与排序 :dense retrieval(title,abstract);retriever(abstract);分类 cs.IR、cs.CL
Comments SIGIR 2023
专题命中 检索器与排序 :dense retrieval(title,abstract);retriever(abstract);分类 cs.IR、cs.AI
Comments Accepted at ReNeuIR 2023 Workshop
专题命中 检索器与排序 :knowledge retrieval(title,abstract);retriever(abstract);分类 cs.IR、cs.CL
Comments ACL 2023
专题命中 检索器与排序 :dense retrieval(title,abstract);retriever(abstract);分类 cs.IR、cs.CL
Comments SIGIR'23 Short
专题命中 检索器与排序 :dense retrieval(title,abstract);retriever(abstract);分类 cs.IR、cs.CL
专题命中 检索器与排序 :dense retrieval(title,abstract);retriever(abstract);分类 cs.IR、cs.CL
专题命中 检索器与排序 :dense retrieval(title,abstract);retriever(abstract);分类 cs.IR、cs.CL
专题命中 检索器与排序 :retriever(title,abstract);dense retrieval(abstract);分类 cs.CL、cs.AI
Comments Presented at NAACL 2022 main conference Code can be found at: https://github.com/primeqa/primeqa
专题命中 检索器与排序 :retriever(title,abstract);dense retrieval(abstract);分类 cs.IR、cs.CL
Comments Accepted at SIGIR 2021 (Full Paper track)
专题命中 检索器与排序 :retriever(title,abstract);hybrid retrieval(abstract);分类 cs.IR、cs.CL
PersonaRAG: 通过以用户为中心的代理增强检索增强生成系统
专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);RAG(abstract,journal_ref);分类 cs.IR
AI总结 PersonaRAG通过引入以用户为中心的代理,提升检索增强生成系统对用户需求的适应能力,实现更精准的个性化回答。
Journal ref Information Retrieval's Role in RAG Systems (IR-RAG) workshop at SIGIR, 2024, Washington D.C., USA
更强的检索增强生成基线:长上下文语言模型
机构 * Stanford University(斯坦福大学)
专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);RAG(abstract,comments);分类 cs.CL
AI总结 本文提出DOS RAG作为长上下文问答任务的强基线,通过保持文档结构和简单性,在多个基准上超越复杂方法。
Comments 11 pages, 6 figures, for associated source code, see https://github.com/alex-laitenberger/stronger-baselines-rag
Journal ref Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing (EMNLP 2025), pages 32559-32569
专题命中 检索器与排序 :RAG(title,abstract);retrieval augmented generation(abstract);分类 cs.AI
Comments Web: https://quanting-xie.github.io/Embodied-RAG-web/
专题命中 检索器与排序 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.IR
Comments 6 pages, 5 Figure, 4 Tables, accepted to IEEE Globecom 2024 (see https://github.com/netop-team/telco-rag)
PrefixPlace:异构计算与传输成本下大语言模型服务的可证明前缀键值放置方案
专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)
AI总结 针对异构计算与传输成本下LLM前缀KV放置的次优问题,提出PrefixPlace规划器,其性能接近最优且效率高,可提升RAG等场景的成本节省效果。
MUSS:多级子集选择用于相关性和多样性
机构 * Equal contribution(共同贡献)
专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)
AI总结 MUSS通过多级方法在推荐系统中提升精确度4个百分点并加快20-80倍,同时在RAG问题回答中优于基线方法。
Comments model in production at Amazon, UAI 2026
从待办事项到安全指南:迈向持续安全合规
专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)
AI总结 本研究针对受监管领域持续软件工程中待办事项安全要求明确困难的问题,提出基于NLP的待办事项丰富系统,结合分类器与RAG管道,发布标注数据集,经评估可有效检测安全相关待办事项并关联安全要求,助力持续安全合规。
Comments 11 pages, 3 figures, 3 tables. Accepted at the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026), Industry Showcase track
利用已解决的事件历史进行大语言模型辅助的软件错误诊断
专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)
AI总结 研究利用已解决事件历史进行软件错误诊断,提出OM-RAG方法,将问题索引为三元组并单跳嵌入检索先例,为大语言模型管理员提供支持,实验表明该方法在诊断准确率和修复正确性上优于其他方法。
Comments 6 pages, 3 figures, accepted at IEEE SMC 2026
MechMem-RTL:用于基于大语言模型的RTL修复的可复用验证机制存储器
专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)
AI总结 研究针对大语言模型修复RTL设计时,利用任务文本相似性易误导的问题,提出MechMem-RTL框架,复用验证器确认的修复记录,通过严格匹配触发证据来注入记录,实验表明该框架在多个任务上修复效果优于标准反馈修复和任务相似性RAG。
Comments 7 pages, 6 figures, 3 tables
有毒剧本:揭秘知识投毒对AI安全代理的影响
专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)
AI总结 研究揭示通过RAG注入单条有毒安全知识可系统性改变AI安全代理行为,提出验证边界(VB)分类法,并评估验证提示与多源检索的防御效果。
A2RAG:面向成本感知和可靠推理的自适应代理图检索
机构 * University of New South Wales(新南威尔士大学) ; Euler AI ; Sigma Trading Management(Sigma 交易管理) ; Eigenflow AI ; Macquarie University(麦考瑞大学)
专题命中 检索器与排序 :RAG(abstract,abstract_cn);retrieval-augmented generation(abstract);retriever(abstract);分类 cs.IR、cs.AI、cs.DB
AI总结 本文提出A2RAG框架,通过自适应控制器和代理检索器解决图检索中成本和可靠性问题,提升多跳问答的准确率并减少计算开销。
PRECISE: 使用预测驱动的排名估计减少LLM评估的偏差
机构 * Primary contributor and corresponding author(主要贡献者及通讯作者)
专题命中 检索器与排序 :RAG(summary_cn,abstract);分类 cs.IR、cs.CL、cs.AI
AI总结 提出PRECISE框架,通过结合少量人工标注与LLM判断,利用预测驱动推断(PPI)方法,在低资源下可靠估计搜索、排序和RAG系统的指标,并校正LLM偏差。
Comments Accepted at AAAI 2026 - Innovative Applications of AI (IAAI-26)
AI技术的共创:赋能文化遗产信息策展人并守护研究公地
专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)
AI总结 本文通过描述在文化遗产数字收藏中应用检索增强生成(RAG)技术的工程历程,展示了AI技术如何赋能策展人并保护研究公地。
Comments 30 pages, chapter in the book Understanding Science with Large Language Models? (pp. 383-412). transcript. Edited by Arno Simons, Adrian Wüthrich, Michael Zichert, Gerd Graßhoff (eds.)
生成式AI反馈、英语写作与教师评分标准:关于CyberScholar的多案例研究
专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)
AI总结 本研究探讨了生成式AI工具CyberScholar在支持K-12学生跨学科写作中的潜力,通过整合教师提供的评分标准、材料和范例,利用检索增强生成(RAG)技术提供基于评分标准的形成性反馈和评分。研究发现学生重视即时的评分标准反馈,并在修改过程中注意到写作能力的提升,但同时也指出了自动评分系统的一致性和与作业要求的匹配问题。
Comments 31 pages, 2 figures, 2 tables
前瞻性引导的记忆检索:语言模型中的记忆检索
机构 * University of Washington(华盛顿大学) ; Microsoft Research(微软研究院)
专题命中 检索器与排序 :RAG(abstract,abstract_cn);retrieval-augmented generation(abstract);dense retrieval(abstract);分类 cs.IR、cs.CL、cs.AI
AI总结 前瞻性引导的记忆检索通过模拟未来步骤来增强长周期检索,提升用户个性化需求的响应质量。
Comments Preprint
对Linux内核中虚假正例缺陷报告的特征分析与缓解
专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)
AI总结 本文研究Linux内核中虚假正例缺陷报告的问题,通过构建2006份报告数据集,发现虚假正例需与真实缺陷同等努力,主要出现在文件系统和驱动程序中,采用RAG策略可实现91%召回率和88%F1分数。
Comments Accepted in the Research Track in FSE 2026
内部检索:基于注意力模型的内在能力
机构 * NVIDIA ; Department of Electrical Engineering, Technion, Haifa, Israel(技术学院电子工程系,以色列海法)
专题命中 检索器与排序 :retrieval-augmented generation(abstract,abstract_cn);RAG(abstract,abstract_cn);retriever(abstract)
AI总结 本文提出INTRA框架,通过注意力机制直接从内部表征检索证据,统一检索与生成流程,提升问答任务的召回与生成质量。
基于检索增强的LLM在纵向电子健康记录叙事中证据定位的临床试验招募
机构 * Department of Health Outcomes and Biomedical Informatics(健康结果与生物医学信息学系) ; University of Florida(佛罗里达大学)
专题命中 检索器与排序 :RAG(summary_cn,abstract);分类 cs.IR、cs.CL、cs.AI
AI总结 本文研究了基于编码器和解码器的生成LLM在临床试验招募中的应用,通过三种策略缓解长文档处理问题,MedGemma模型在RAG策略下达到89.05%的微F1分数,提升了长期推理能力。
UrbanClipAtlas:面向城市视频中事件和场景检索的视觉分析框架
专题命中 检索器与排序 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)
AI总结 本文提出UrbanClipAtlas框架,结合RAG、实体提取和视频定位技术,实现城市视频中事件和场景的高效检索与解释,通过知识图谱和增强聊天界面提升分析效率。
Comments 12 pages and 6 figures
BioModelsRAG: 一种使用检索增强生成技术的生物建模助手
专题命中 检索器与排序 :retrieval augmented generation(title);RAG(title)
AI总结 BioModelsRAG通过检索增强生成技术,帮助用户快速提取生物模型的关键信息,提高分析效率和准确性。