arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 543 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 知识库问答 543 篇

2503.18760 2026-05-13 cs.CL 70%

Synthetic Function Demonstrations Improve Generation in Low-Resource Programming Languages

合成函数演示提升低资源编程语言生成能力

Nick McKenna, Xinnuo Xu, Jack Williams, Nick Wilson, Benjamin Van Durme, Christian Poelitz

机构 * Microsoft Research, Microsoft(微软研究院,微软)

专题命中 知识库问答 :RAG(abstract,abstract_cn);分类 cs.CL

AI总结 本文提出通过生成合成演示数据提升低资源编程语言生成性能,通过教师模型生成训练数据并微调学生模型,在Excel公式领域取得显著效果。

Comments Published at LREC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01471 2026-05-05 cs.SE cs.AI 70%

Practical Limits of Autonomous Test Repair: A Multi-Agent Case Study with LLM-Driven Discovery and Self-Correction

自主测试修复的实践极限:基于LLM驱动发现与自我校正的多智能体案例研究

Hyukjoo Lee

机构 * Independent Researcher(独立研究者)

专题命中 知识库问答 :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 本文通过多智能体系统在企业UI测试中的应用,探讨自主测试的限制,发现受限自主性能提升系统稳定性与可靠性,需结合验证边界和人工监督。

Comments Industrial case study; submitted for review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01077 2026-05-05 cs.CL 70%

Teaching LLMs Brazilian Healthcare: Injecting Knowledge from Official Clinical Guidelines

教大语言模型巴西医疗:注入官方临床指南的知识

Hugo Abonizio, Filipe Rocha Lopes, Roberto Lotufo, Rodrigo Nogueira

机构 * FEEC, UNICAMP(UNICAMP电子工程学院) Maritaca AI

专题命中 知识库问答 :RAG(abstract,abstract_cn);分类 cs.CL

AI总结 本文通过适配Qwen2.5-14B-Instruct模型,生成合成数据并采用持续预训练和GRPO方法,构建了HealthBench-BR和PCDT-QA基准,实现了在巴西医疗领域上的高准确率表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09282 2026-04-14 cs.SD cs.CL 70%

End-to-end Contrastive Language-Speech Pretraining Model For Long-form Spoken Question Answering

端到端对比语言-语音预训练模型用于长形式语音问答

Jiliang Hu, Zuchao Li, Baoyuan Qi, Liu Guoming, Ping Wang

专题命中 知识库问答 :retrieval augmented generation(abstract);retriever(abstract);分类 cs.CL

AI总结 本文提出CLSR模型,通过将音频特征转换为文本表示,提升长音频问答任务的性能,实验表明其优于现有方法。

Comments 12 pages, 7 figures, accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07012 2026-04-09 cs.CL 70%

DTCRS: Dynamic Tree Construction for Recursive Summarization

DTCRS: 动态树构建用于递归摘要

Guanran Luo, Zhongquan Jian, Wentao Qiu, Meihong Wang, Qingqiang Wu

机构 * School of Informatics, Xiamen University(厦门大学信息学院)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

AI总结 DTCRS通过动态生成摘要树减少冗余,提升摘要与问题的相关性,从而加快构建时间并改进三个问答任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02259 2026-04-03 hep-ex cs.AI physics.ins-det 70%

Retrieval-Augmented Question Answering over Scientific Literature for the Electron-Ion Collider

基于科学文献的电子-离子对撞机检索增强问答

Tina. J. Jat, T. Ghosh, Karthik Suresh

机构 * Ramaiah University of Applied Sciences, India(印度拉马伊亚应用科学大学)

专题命中 知识库问答 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 本文提出一种基于检索增强生成的问答系统,利用arXiv文献和LLaMA模型回答核物理领域专业问题,提供隐私保护且成本低廉的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14265 2026-03-17 cs.CL cs.MA 70%

MedPriv-Bench: Benchmarking the Privacy-Utility Trade-off of Large Language Models in Medical Open-End Question Answering

MedPriv-Bench:医疗开放问答中大语言模型隐私-效用权衡的基准测试

Shaowei Guan, Yu Zhai, Hin Chi Kwok, Jiawei Du, Xinyu Feng, Jing Li, Harry Qin, Vivian Hui

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

AI总结 MedPriv-Bench首次提出医疗开放问答中评估隐私保护与临床效用的基准,通过多代理人机协同流程生成敏感医疗情境,利用预训练RoBERTa-NLI模型量化数据泄露,揭示大语言模型在隐私与效用间的普遍权衡。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22050 2026-03-03 cs.CL 70%

DeepSieve: Information Sieving via LLM-as-a-Knowledge-Router

DeepSieve: 通过LLM作为知识路由器实现信息筛分

Minghao Guo, Qingcheng Zeng, Xujiang Zhao, Yanchi Liu, Wenchao Yu, Mengnan Du, Haifeng Chen, Wei Cheng

机构 * Rutgers University(罗格斯大学) Northwestern University(西北大学) NEC Laboratories America(NEC美国实验室) NJIT(新泽西理工学院)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

AI总结 DeepSieve通过LLM作为知识路由器实现信息筛分,提升多跳问答任务的推理深度、检索精度和可解释性。

Comments Accepted by EACL Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20926 2026-02-25 cs.AI 70%

HELP: HyperNode Expansion and Logical Path-Guided Evidence Localization for Accurate and Efficient GraphRAG

HELP: 图形节点扩展与逻辑路径引导的证据定位用于准确且高效的图RAG

Yuqi Huang, Ning Liao, Kai Yang, Anning Hu, Shengchao Hu, Xiaoxing Wang, Junchi Yan

机构 * Shanghai Jiao Tong University, China(上海交通大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 HELP通过HyperNode扩展和逻辑路径引导的证据定位策略,提升图RAG在准确性和效率之间的平衡,实现高效且准确的知识检索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19240 2026-02-24 cs.AI 70%

Topology of Reasoning: Retrieved Cell Complex-Augmented Generation for Textual Graph Question Answering

推理拓扑:检索细胞复杂度增强的生成用于文本图问题回答

Sen Zhao, Lincheng Zhou, Yue Chen, Ding Zou

机构 * Academy of Advanced Interdisciplinary Studies, Chongqing University of Posts and Telecommunications(重庆邮电大学先进交叉学科研究院) School of Computer Science and Technology, Chongqing University of Posts and Telecommunications(重庆邮电大学计算机科学与技术学院) Intelligent System Department, Zhongxing Telecom Equipment (ZTE)(中兴电信设备智能系统部)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 本文提出TopoRAG,通过将文本图提升为细胞复杂度,捕捉高维拓扑依赖,提升文本图问题回答的推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18493 2026-02-24 cs.LG cs.AI 70%

Learning to Remember: End-to-End Training of Memory Agents for Long-Context Reasoning

学习记忆:为长上下文推理端到端训练记忆代理

Kehao Zhang, Shangtong Gui, Sheng Yang, Wei Chen, Yang Feng

机构 * Key Laboratory of Intelligent Information Processing, Institute of Computing Technology, Chinese Academy of Sciences (ICT/CAS)(智能信息处理重点实验室,计算技术研究所,中国科学院) Key Laboratory of AI Safety, Chinese Academy of Sciences(人工智能安全重点实验室,中国科学院) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国) Li Auto Inc.(利亚德公司)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 UMA通过端到端强化学习框架,整合记忆操作与问答,提升长上下文推理任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08364 2026-02-23 cs.CL 70%

Structure-Augmented Reasoning Generation

结构增强的推理生成

Jash Rajesh Parekh, Pengcheng Jiang, Jiawei Han

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

AI总结 结构增强的推理生成通过显式推理结构提升多跳查询的准确性和连贯性,兼容现有RAG流程,无需定制检索器或微调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09945 2026-02-11 cs.AI 70%

Closing Reasoning Gaps in Clinical Agents with Differential Reasoning Learning

通过差异推理学习关闭临床代理中的推理差距

Jinsong Liu, Yuhang Jiang, Ramayya Krishnan, Rema Padman, Yiye Zhang, Jiang Bian

机构 * Dept. of Population Health Sciences, Weill Cornell Medicine, Cornell University(人口健康科学系,韦尔·科恩医学中心,康奈尔大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 DRL通过学习推理差异改进临床代理,提升问答和预测任务的准确性和推理可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06050 2026-02-09 cs.CL cs.CV 70%

Relevance-aware Multi-context Contrastive Decoding for Retrieval-augmented Visual Question Answering

具有相关性的多上下文对比解码用于检索增强的视觉问答

Jongha Kim, Byungoh Ko, Jeehye Na, Jinsung Yoon, Hyunwoo J. Kim

机构 * Korea University(韩国大学) KAIST(韩国科学技术院) Google Cloud AI(谷歌云人工智能)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

AI总结 RMCD通过结合多个相关上下文并抑制无关上下文的负面影响,提升检索增强视觉问答的性能。

Comments WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13105 2026-01-21 cs.CL 70%

Leveraging Lora Fine-Tuning and Knowledge Bases for Construction Identification

利用LoRA微调和知识库进行 constructions 识别

Liu Kaipeng, Wu Ling

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

AI总结 本研究通过LoRA微调和知识库结合,提升大型语言模型对英语双宾结构的识别能力,实验显示微调模型在性能上优于原生模型和理论驱动的RAG系统。

Comments 19pages, 1figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18691 2026-01-16 cs.CL 70%

Investigating LLM Capabilities on Long Context Comprehension for Medical Question Answering

探究大语言模型在医疗问答中的长上下文理解能力

Feras AlMannaa, Talia Tseriotou, Jenny Chim, Maria Liakata

机构 * Istanbul Aydın University(伊斯坦布尔阿迪兰大学) Queen Mary University of London(伦敦女王学院) The Alan Turing Institute(艾伦·图灵研究所)

专题命中 知识库问答 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

AI总结 本研究探讨大语言模型在医疗问答中处理长上下文任务的能力,分析了模型大小、记忆问题及RAG方法的效果,揭示了其在不同任务中的优势与限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06603 2026-01-13 cs.CL 70%

N2N-GQA: Noise-to-Narrative for Graph-Based Table-Text Question Answering Using LLMs

N2N-GQA:基于图的表格-文本问答中的噪声到叙事使用大语言模型

Mohamed Sharafath, Aravindh Annamalai, Ganesh Murugan, Aravindakumar Venugopalan

机构 * comcast India Engineering Center (CIEC)(comcast印度工程中心)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

AI总结 N2N-GQA通过构建动态证据图提升基于图的表格-文本问答性能,实现零样本多跳问答的高准确率。

Comments Accepted at an AAAI 2026 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06152 2026-01-13 cs.AI 70%

HiMeS: Hippocampus-inspired Memory System for Personalized AI Assistants

HiMeS:基于海马体的记忆系统用于个性化AI助手

Hailong Li, Feifei Li, Wenhui Que, Xingyu Fan

机构 * Tencent Inc.(腾讯公司)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 HiMeS通过融合短期和长期记忆机制,提升个性化AI助手在知识密集型场景中的问答质量与用户定制能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05465 2026-01-12 cs.AI 70%

PRISMA: Reinforcement Learning Guided Two-Stage Policy Optimization in Multi-Agent Architecture for Open-Domain Multi-Hop Question Answering

PRISMA:基于强化学习的多智能体架构中两阶段策略优化

Yu Liu, Wenxiao Zhang, Cong Cao, Wenxuan Lu, Fangfang Yuan, Diandian Guo, Kun Peng, Qiang Sun, Kaiyan Zhang, Yanbing Liu, Jin B. Hong, Bowen Zhou, Zhiyuan Ma

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 PRISMA通过两阶段组相对策略优化,结合推理引导协作,解决多跳问答中的检索崩溃和学习不稳定问题,实现高性能和稳定部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23730 2025-12-09 cs.CL 70%

Evaluating Long-Term Memory for Long-Context Question Answering

评估长期记忆以实现长上下文问答

Alessandra Terranova, Björn Ross, Alexandra Birch

机构 * School of Informatics, The University of Edinburgh(信息学院,爱丁堡大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

AI总结 本文评估了增强记忆方法在长上下文问答任务中的效果,发现通过RAG和事件记忆可显著减少令牌使用并保持准确性。

Comments Accepted as a poster at Metacognition in Generative AI EurIPS workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03100 2025-12-04 cs.CR cs.AI 70%

Ensemble Privacy Defense for Knowledge-Intensive LLMs against Membership Inference Attacks

知识密集型大语言模型的集成隐私防御:对抗成员推断攻击

Haowei Fu, Bo Ni, Han Xu, Kunpeng Liu, Dan Lin, Tyler Derr

机构 * Vanderbilt University(范德比大学) University of Arizona(亚利桑那大学) Clemson University(克莱姆森大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 本文提出集成隐私防御框架EPD,通过聚合知识注入LLM、基础LLM和专用判断模型的输出,有效降低成员推断攻击的成功率,提升知识密集型大语言模型的隐私安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19753 2025-11-21 cs.CL 70%

CoTKR: Chain-of-Thought Enhanced Knowledge Rewriting for Complex Knowledge Graph Question Answering

CoTKR: 基于链式推理的增强型知识重写用于复杂知识图谱问答

Yike Wu, Yi Huang, Nan Hu, Yuncheng Hua, Guilin Qi, Jiaoyan Chen, Jeff Z. Pan

机构 * Southeast University(东南大学) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University) Ministry of Education(新一代人工智能技术及其交叉应用国家重点实验室) China Mobile Research Institute(中国移动研究院) Monash University(墨尔本大学) University of Manchester(曼彻斯特大学) University of Edinburgh(爱丁堡大学)

专题命中 知识库问答 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

AI总结 CoTKR通过链式推理增强知识重写方法,提升复杂知识图谱问答性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13489 2025-11-18 cs.ET cs.IR 70%

PolicyBot - Reliable Question Answering over Policy Documents

Gautam Nagarajan, Omir Kumar, Sudarsun Santhiappan

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18468 2025-10-22 cs.CL 70%

IMB: An Italian Medical Benchmark for Question Answering

Antonio Romano, Giuseppe Riccio, Mariano Barone, Marco Postiglione, Vincenzo Moscato

机构 * University of Naples Federico II, Department of Electrical Engineering(那不勒斯费德里科二世大学电子工程系) Consorzio Interuniversitario Nazionale per l'Informatica (CINI) - ITEM National Lab(国家信息计算联合研究中心(CINI)- ITEM国家实验室) Northwestern University, Department of Computer Science, McCormick School of Engineering(西北大学计算机科学系,工程学院)

专题命中 知识库问答 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Journal ref CLIC-it 2025: Eleventh Italian Conference on Computational Linguistics, Cagliari, Italy, September 24-26, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08383 2025-10-10 cs.AI 70%

QAgent: A modular Search Agent with Interactive Query Understanding

Yi Jiang, Lei Shen, Lujie Niu, Sendong Zhao, Wenbo Su, Bo Zheng

机构 * Alibaba(阿里巴巴)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments Code is available at https://github.com/OpenStellarTeam/QAgent

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21856 2025-09-29 cs.CL 70%

KnowMT-Bench: Benchmarking Knowledge-Intensive Long-Form Question Answering in Multi-Turn Dialogues

Junhao Chen, Yu Huang, Siyuan Li, Rui Yao, Hanqian Li, Hanyu Zhang, Jungang Li, Jian Chen, Bowen Wang, Xuming Hu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Hong Kong University of Science and Technology(香港科技大学) The University of Osaka(大阪大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20608 2025-09-23 cs.AI cs.NA math.NA 70%

AI Assistants to Enhance and Exploit the PETSc Knowledge Base

Barry Smith, Junchao Zhang, Hong Zhang, Lois Curfman McInnes, Murat Keceli, Archit Vasan, Satish Balay, Toby Isaac, Le Chen, Venkatram Vishwanath

机构 * Flatiron Institute, Simons Foundation(Flatiron研究所、Simons基金会) Argonne National Laboratory(阿贡国家实验室)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Journal ref 54th International Conference on Parallel Processing Companion (ICPP Companion '25), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00608 2025-09-23 cs.CL 70%

PAKTON: A Multi-Agent Framework for Question Answering in Long Legal Agreements

Petros Raptopoulos, Giorgos Filandrianos, Maria Lymperaiou, Giorgos Stamou

机构 * School of Electrical and Computer Engineering, AILS Laboratory, National Technical University of Athens(电气与计算机工程学院,AILS实验室,国家技术大学雅典) Instituto de Telecomunicações(电信研究所)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15213 2025-09-19 cs.CL 70%

Select to Know: An Internal-External Knowledge Self-Selection Framework for Domain-Specific Question Answering

Bolei He, Xinran He, Run Shao, Shanfu Shu, Xianwei Xue, Mingquan Cheng, Haifeng Li, Zhenhua Ling

机构 * University of Science and Technology of China(中国科学技术大学) Baidu Inc.(百度公司) Central South University(中南大学) Chongqing University(重庆大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments EMNLP2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02363 2025-09-03 cs.CL 70%

Towards Temporal Knowledge-Base Creation for Fine-Grained Opinion Analysis with Language Models

Gaurav Negi, Atul Kr. Ojha, Omnia Zayed, Paul Buitelaar

机构 * Insight SFI Research Ireland Centre for Data Analytics, University of Galway(爱尔兰数据分析师中心,Galway大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏