arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-03-19 至 2026-03-19 共收录 7 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 7 篇

2603.17292 2026-03-19 cs.CR 82%

SEAL-Tag: Self-Tag Evidence Aggregation with Probabilistic Circuits for PII-Safe Retrieval-Augmented Generation

SEAL-Tag: 基于概率电路的自标签证据聚合用于PII安全检索增强生成

Jin Xie, Songze Li, Guang Cheng

专题命中 检索器与排序 :retrieval-augmented generation(title,abstract);RAG(abstract)

AI总结 SEAL-Tag通过概率电路和验证-路由范式,解决检索增强生成中隐私泄露问题,减少泄露8倍同时保持性能。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17580 2026-03-19 cs.IR 79%

Negation is Not Semantic: Diagnosing Dense Retrieval Failure Modes for Trade-offs in Contradiction-Aware Biomedical QA

否定并非语义:诊断密集检索失败模式以权衡矛盾意识生物医学问答

Soumya Ranjan Sahoo, Gagan N., Sanand Sasidharan, Divya Bharti

专题命中 检索器与排序 :dense retrieval(title,abstract);分类 cs.IR

AI总结 本文研究了密集检索在矛盾意识生物医学问答中的失败模式,提出解耦词法架构和叙事感知重排序方法,提升矛盾检测和引用覆盖能力,实现高精度和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17176 2026-03-19 cs.CR cs.AI 79%

Towards Unsupervised Adversarial Document Detection in Retrieval Augmented Generation Systems

面向检索增强生成系统中无监督对抗文档检测

Patrick Levi

机构 * Department of Electrical Engineering, Media, and Computer Science(电气工程、媒体与计算机科学系)

专题命中 检索器与排序 :retrieval augmented generation(title,abstract);分类 cs.AI

AI总结 本文提出无监督方法检测检索增强生成系统中的对抗性上下文文档,通过生成器激活、输出嵌入和熵基不确定性度量等指标,展示零日攻击检测能力,并证明目标提示非必需。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17208 2026-03-19 cs.CL cs.PL 77%

SYMDIREC: A Neuro-Symbolic Divide-Retrieve-Conquer Framework for Enhanced RTL Synthesis and Summarization

SYMDIREC:一种用于增强RTL综合与摘要的神经符号分割-检索-解决框架

Prashanth Vijayaraghavan, Apoorva Nitsure, Luyao Shi, Charles Mackin, Ashutosh Jadhav, David Beymer, Ehsan Degan, Vandana Mukherjee

机构 * IBM Research(IBM研究院)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);RAG(abstract);retriever(abstract);分类 cs.CL

AI总结 SYMDIREC通过结合符号规划与LLM推理,提升RTL综合与摘要的准确性,实现比基线方法更高的Pass@1率和ROUGE-L分数。

Journal ref EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21737 2026-03-19 cs.IR 57%

DPDisc: From Factoid Questions to Data Product Requests for Open-World Data Product Discovery over Tables and Text

DPDisc: 从事实性问题到数据产品请求的开放世界数据产品发现 over 表格和文本

Liangliang Zhang, Nandana Mihindukulasooriya, Niharika S. D'Souza, Sola Shirai, Sarthak Dash, Yao Ma, Horst Samulowitz

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.IR

AI总结 DPDisc 是首个针对混合表格-文本语料库的数据产品发现基准,通过自动化流程生成专业级请求并验证质量,包含13076个经过验证的实例,揭示了跨领域检索方法的性能差距。

Comments 15 pages, 4 figure, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17425 2026-03-19 cs.AI 57%

Proactive Knowledge Inquiry in Doctor-Patient Dialogue: Stateful Extraction, Belief Updating, and Path-Aware Action Planning

医生-患者对话中的主动知识探究:状态提取、信念更新与路径感知的动作规划

Zhenhai Pan, Yan Liu, Jia You

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.AI

AI总结 本文提出了一种基于部分可观测性的主动知识探究框架,通过状态提取、信念更新和路径感知动作规划,提升电子病历生成的覆盖性和准确性。

Comments 12 pages, 2 figures, 5 tables. Pilot concept demonstration under a controlled simulated setting

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12214 2026-03-19 cs.CR 50%

InferDPT: Privacy-Preserving Inference for Closed-box Large Language Model

InferDPT:闭箱大语言模型的隐私保护推断

Meng Tong, Kejiang Chen, Jie Zhang, Yuang Qi, Weiming Zhang, Nenghai Yu, Tianwei Zhang, Zhikun Zhang

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 本文提出InferDPT框架,通过差分隐私机制实现闭箱大语言模型的隐私保护推断,结合扰动模块和提取模块,提升文本生成质量并抵御嵌入式修订攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏