arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 8572 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 知识库问答 545 篇

2608.13160 2026-08-14 cs.CL cs.AI 新提交 62%

Better Decomposition, Free Aggregation: A Synthesizer-Folding Framework for Multilingual Multi-Hop Question Answering

更好的分解,自由聚合:面向多语言多跳问答的合成器折叠框架

Yilin Wang, Yuchun Fan, Weidong Bao, Zili Wei, Shi Feng, Tong Xiao, Zhengtao Yu, Jingbo Zhu

机构 * School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院) Kunming University of Science and Technology(昆明理工大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 针对多语言多跳问答中现有方法的翻译噪声与错误放大问题,提出Syfer框架,通过推迟翻译、格式受限分解与质量检查实现性能与成本的良好平衡。

Comments Accepted by NLPCC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19867 2026-07-23 cs.CL cs.AI cs.CE 新提交 62%

Overview of FinMMEval 2026 Task 2: Multilingual Financial Short-Answer Question Answering

FinMMEval 2026任务2概述:多语言金融简答题问答

Zhuohan Xie, Xueqing Peng, Georgi Georgiev, Dimitar Dimitrov, Yuyang Dai, Rania Elbadry, Vanshikaa Jani, Lingfei Qian, Fan Zhang, Jimin Huang, Jiahui Geng, Yankai Chen, Ye Yuan, Haolun Wu, Yuxia Wang, Ivan Koychev, Veselin Stoyanov, Mingzi Song, Yu Chen, Xue Liu, Preslav Nakov

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) The Fin AI(金融人工智能公司) FMI, Sofia University “St. Kliment Ohridski”(索非亚大学“圣克莱门特·奥赫里德斯基”金融数学与信息学系) INSAIT, Sofia University “St. Kliment Ohridski”(索非亚大学“圣克莱门特·奥赫里德斯基”信息技术与自动化研究所) University of Arizona(亚利桑那大学) The University of Tokyo(东京大学) Linköping University(林雪平大学) McGill University(麦吉尔大学) Mila, Quebec AI Institute(魁北克人工智能研究所) Meiji Gakuin University(明治学院大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 FinMMEval 2026任务2聚焦多语言金融简答题问答,通过特定配对和格式让系统答题,最终测试集含256个项目分两层级,依ROUGE-1 F1排名,最强系统差距小,还记录了多种相关策略。

Comments 9 pages. Task overview paper for CLEF 2026 Working Notes (CEUR Workshop Proceedings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06527 2026-07-08 cs.CL cs.AI 新提交 62%

RSF-GLLM: Bridging the Semantic Gap in Multi-Hop Knowledge Graph QA via Recurrent Soft-Flow and Decoupled LLM Generation

RSF-GLLM:通过循环软流和去耦语言模型生成弥合多跳知识图谱问答中的语义鸿沟

Sambaran Bandyopadhyay, Ananth Muppidi

机构 * Adobe Research(Adobe研究院) Adobe Systems(Adobe系统公司)

专题命中 知识库问答 :retriever(abstract);分类 cs.CL、cs.AI

AI总结 研究多跳知识图谱问答中传统方法的语义鸿沟问题,提出RSF-GLLM框架,通过循环软流模块传播分数、引入正则化保证收敛,提取路径微调LLM,实验证明该方法性能优且推理效率高。

Comments Accepted for publication in ICML 2026 as a full research paper; 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28831 2026-06-09 cs.CL cs.AI 版本更新 62%

S3Mem: Structured Spatiotemporal Scene-Event Memory for Long-Horizon Interactive Question Answering

S3Mem:用于长时域交互式问答的结构化时空场景-事件记忆

Encheng Su, Jianyu Wu, Jinouwen Zhang, Qiucheng Yu, Chen Tang, Pengze Li, Lintao Wang, Aoran Wang, Xinzhu Ma, Shixiang Tang, Yizhou Wang, Houqiang Li

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) City University of Hong Kong(香港城市大学) The Chinese University of Hong Kong(香港中文大学) Fudan University(复旦大学) The University of Sydney(悉尼大学) Beihang University(北航)

专题命中 知识库问答 :RAG(abstract_cn);分类 cs.CL、cs.AI

AI总结 提出S3MEM框架,通过结构化场景-事件记忆和锚点敏感检索,在长时域交互式问答中实现比通用记忆接口更优的准确率-效率平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06171 2026-04-29 cs.CL cs.AI 62%

LLM-Augmented Knowledge Base Construction For Root Cause Analysis

基于大语言模型的知识库构建用于根本原因分析

Nguyen Phuc Tran, Brigitte Jaumard, Oscar Delgado, Tristan Glatard, Karthikeyan Premkumar, Kun Ni

机构 * Department of Computer Science and Software Engineering, Concordia University(计算机科学与软件工程系,康科迪亚大学) École de Technologie Supérieure(高级技术学院) GAIA-Ericsson Montréal, Canada(蒙特利尔加拿大GAIA-爱立信)

专题命中 知识库问答 :RAG(abstract);分类 cs.CL、cs.AI

AI总结 本文评估了三种大语言模型方法,用于从支持票中构建根本原因分析知识库,通过词法和语义相似性指标比较其性能,实验表明生成的知识库能有效加速RCA任务并提升网络韧性。

Comments This work has been accepted for publication in IEEE Access. The final published version will be available via IEEE Xplore

Journal ref 2026 IEEE Access

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14984 2026-04-23 cs.CL cs.IR 62%

CRAFT: Training-Free Cascaded Retrieval for Tabular QA

CRAFT:无训练 cascaded 检索用于表格问答

Adarsh Singh, Kushal Raj Bhandari, Jianxi Gao, Soham Dan, Vivek Gupta

机构 * Arizona State University(亚利桑那州立大学) Rensselaer Polytechnic Institute(伦塞拉尔理工学院) Microsoft(微软)

专题命中 知识库问答 :dense retrieval(abstract);分类 cs.IR、cs.CL

AI总结 CRAFT 提出了一种无训练 cascaded 检索方法,通过稀疏检索模型筛选候选表格后,再用密集模型进行重排序,提升检索质量并在 NQ-Tables 和 OTT-QA 数据集上表现优异。

Comments Accepted to ACL 2026 Mains

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16401 2026-04-21 cs.IR cs.AI 62%

GraphRAG-Router: Learning Cost-Efficient Routing over GraphRAGs and LLMs with Reinforcement Learning

GraphRAG-Router: 通过强化学习学习高效的图RAGs和LLM路由

Dongzhe Fan, Chuanhao Ji, Zimu Wang, Tong Chen, Qiaoyu Tan

机构 * Department of Computer Science, New York University (Shanghai)(纽约大学(上海)计算机科学系) Department of Computer Science, University of Liverpool(利物浦大学计算机科学系)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.IR、cs.AI

AI总结 本文提出GraphRAG-Router,通过分层路由策略协调异构图RAGs和生成LLM,通过强化学习优化生成分配,降低大模型使用成本并提升泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06737 2026-04-13 cs.CL cs.AI 62%

WisdomInterrogatory (LuWen): An Open-Source Legal Large Language Model Technical Report

WisdomInterrogatory (LuWen): 一种开源法律大语言模型技术报告

Yiquan Wu, Yuhang Liu, Yifei Liu, Ang Li, Siying Zhou, Kun Kuang, Fei Wu

机构 * Zhejiang University(浙江大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 本文提出基于Baichuan模型的开源中文法律语言模型LuWen,通过持续预训练、监督微调和检索增强生成技术,提升法律领域任务表现。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22715 2026-04-01 cs.CV cs.AI cs.CL cs.MM 62%

ReAG: Reasoning-Augmented Generation for Knowledge-based Visual Question Answering

ReAG:基于推理的生成用于基于知识的视觉问答

Alberto Compagnoni, Marco Morini, Sara Sarto, Federico Cocchi, Davide Caffagni, Marcella Cornia, Lorenzo Baraldi, Rita Cucchiara

机构 * University of Modena and Reggio Emilia(摩德纳大学和雷焦艾米利亚大学) University of Pisa(比萨大学)

专题命中 知识库问答 :RAG(abstract);分类 cs.CL、cs.AI

AI总结 ReAG通过结合粗粒度和细粒度检索及批评模型过滤无关信息,提升知识密集型视觉问答的准确性和可解释性。

Comments CVPR 2026 - Project page: https://aimagelab.github.io/ReAG/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05658 2026-03-31 cs.CL cs.AI 62%

Multilingual Medical Reasoning for Question Answering with Large Language Models

多语言医疗推理用于问答的大型语言模型

Pietro Ferrazzi, Aitor Soroa, Rodrigo Agerri

机构 * HiTZ Center - Ixa, University of the Basque Country EHU(HiTZ中心 - Ixa,巴斯克大学EHU)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 本文提出基于维基百科医疗知识生成多语言推理轨迹的方法,通过检索增强生成技术生成英文、意大利语和西班牙语的50万条轨迹,提升医疗问答性能,达到8B参数模型的最新水平。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23554 2026-03-26 cs.IR cs.AI 62%

Mixture of Demonstrations for Textual Graph Understanding and Question Answering

演示混合用于文本图理解与问答

Yukun Wu, Lihui Liu

机构 * Independent Researcher, Wayne State University(韦恩州立大学独立研究者) Institute for Clarity in Documentation(文档清晰研究所) Inria Paris-Rocquencourt(巴黎-罗克琴court研究所) Rajiv Gandhi University(拉吉夫·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.IR、cs.AI

AI总结 本文提出MixDemo框架,通过MoE机制选择信息丰富的演示,结合查询特定图编码器减少噪声,提升文本图问答性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20432 2026-03-24 cs.CL cs.AI 62%

Coding Agents are Effective Long-Context Processors

编码代理是有效的长上下文处理器

Weili Cao, Xunjian Yin, Bhuwan Dhingra, Shuyan Zhou

机构 * Duke University(杜克大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 本文研究通过允许编码代理在文件系统中组织文本并使用其原生工具处理长上下文,发现编码代理在长上下文推理、检索增强生成和开放领域问答中表现优异,比现有最佳方法平均提升17.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01990 2026-03-03 cs.AI cs.CL cs.CV 62%

According to Me: Long-Term Personalized Referential Memory QA

根据我:长期个性化参照记忆问答

Jingbiao Mei, Jinghong Chen, Guangyu Yang, Xinyu Hou, Margaret Li, Bill Byrne

机构 * Department of Engineering, University of Cambridge, United Kingdom(剑桥大学工程系) Department of Physics, University of Cambridge, United Kingdom(剑桥大学物理系) Independent Researcher(独立研究者)

专题命中 知识库问答 :RAG(abstract);分类 cs.CL、cs.AI

AI总结 本文提出ATM-Bench,首个多模态多来源个性化参照记忆问答基准,并提出Schema-Guided Memory方法提升记忆推理性能

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21212 2026-02-26 cs.CL cs.IR cs.LG 62%

Disaster Question Answering with LoRA Efficiency and Accurate End Position

利用LoRA效率和准确端位置的灾难问答

Takato Yasuno

专题命中 知识库问答 :RAG(abstract);分类 cs.IR、cs.CL

AI总结 本文提出一种基于日本灾难经验的问答系统,利用LoRA优化实现高准确率的灾难响应问答。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18425 2026-02-23 cs.CL cs.IR 62%

RVR: Retrieve-Verify-Retrieve for Comprehensive Question Answering

RVR:用于综合问答的检索-验证-检索

Deniz Qian, Hung-Ting Chen, Eunsol Choi

机构 * Courant Institute School of Mathematics, Computing, and Data Science, New York University(纽约大学Courant研究所数学、计算与数据科学学院) Courant Institute School of Mathematics, Computing(纽约大学Courant研究所数学、计算与数据科学学院) Data Science, New York University(纽约大学数据科学学院)

专题命中 知识库问答 :retriever(abstract);分类 cs.IR、cs.CL

AI总结 RVR提出了一种多轮检索框架,通过验证器和检索器优化,提升多答案检索的召回率和覆盖范围。

Comments 18 pages, 12 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17173 2026-01-27 cs.CL cs.AI 62%

Beyond Factual QA: Mentorship-Oriented Question Answering over Long-Form Multilingual Content

超越事实问答:面向长形式多语言内容的指导型问答

Parth Bhalerao, Diola Dsouza, Ruiwen Guan, Oana Ignat

专题命中 知识库问答 :RAG(abstract);分类 cs.CL、cs.AI

AI总结 本文提出MentorQA,首个多语言长形式视频指导型问答数据集和评估框架,通过对比不同架构发现Multi-Agent在复杂和低资源语言中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24830 2026-01-01 cs.CL cs.AI 62%

Improving Reliability and Explainability of Medical Question Answering through Atomic Fact Checking in Retrieval-Augmented LLMs

通过检索增强的大语言模型中的原子事实核查来提高医疗问答的可靠性与可解释性

Juraj Vladika, Annika Domres, Mai Nguyen, Rebecca Moser, Jana Nano, Felix Busch, Lisa C. Adams, Keno K. Bressem, Denise Bernhardt, Stephanie E. Combs, Kai J. Borm, Florian Matthes, Jan C. Peeken

专题命中 知识库问答 :retrieval augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 通过原子事实核查提升医疗问答的可靠性与可解释性,减少幻觉并提高事实准确性。

Comments 18 pages, 7 figures and tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23836 2026-01-01 cs.CL cs.AI cs.LG 62%

Retrieval Augmented Question Answering: When Should LLMs Admit Ignorance?

检索增强型问答:当LLMs应承认无知时

Dingmin Wang, Ji Ma, Shankar Kumar

机构 * Google Research(谷歌研究) University of Oxford(牛津大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种自适应提示策略,通过分割检索信息并逐步提示LLM回答问题,以提高问答性能并减少无关信息的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04741 2025-12-02 cs.AI cs.CL cs.HC 62%

Question Answering for Decisionmaking in Green Building Design: A Multimodal Data Reasoning Method Driven by Large Language Models

绿色建筑设计中的决策制定问答:一种由大语言模型驱动的多模态数据推理方法

Yihui Li, Xiaoyue Yan, Hao Zhou, Borong Lin

机构 * School of Architecture(建筑学院) Tsinghua University(清华大学)

专题命中 知识库问答 :retrieval augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出GreenQA,一种由大语言模型驱动的多模态数据推理方法,用于提升绿色建筑设计决策效率。

Comments Published at Association for Computer Aided Design in Architecture (ACADIA) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14099 2025-11-18 cs.CL cs.IR 62%

Beyond Chains: Bridging Large Language Models and Knowledge Bases in Complex Question Answering

Yihua Zhu, Qianying Liu, Akiko Aizawa, Hidetoshi Shimodaira

专题命中 知识库问答 :RAG(abstract);分类 cs.IR、cs.CL

Comments AAAI2026 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09179 2025-11-13 cs.CL cs.AI 62%

A Hybrid Search for Complex Table Question Answering in Securities Report

Daiki Shirafuji, Koji Tanaka, Tatsuhiko Saito

专题命中 知识库问答 :hybrid retrieval(abstract);分类 cs.CL、cs.AI

Comments Accepted to IIAI AAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06446 2025-11-11 cs.CL cs.AI 62%

SR-KI: Scalable and Real-Time Knowledge Integration into LLMs via Supervised Attention

Bohan Yu, Wei Huang, Kang Liu

机构 * Baidu(百度)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13721 2025-09-30 cs.CL cs.AI 62%

Continual Dialogue State Tracking via Example-Guided Question Answering

Hyundong Cho, Andrea Madotto, Zhaojiang Lin, Khyathi Raghavi Chandu, Satwik Kottur, Jing Xu, Jonathan May, Chinnadhurai Sankar

机构 * Information Sciences Institute, University of Southern California(美国南加州大学信息科学研究所) Meta AI

专题命中 知识库问答 :retriever(abstract);分类 cs.CL、cs.AI

Comments 11 pages, EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09316 2025-09-25 cs.CL cs.IR 62%

Scent of Knowledge: Optimizing Search-Enhanced Reasoning with Information Foraging

Hongjin Qian, Zheng Liu

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.IR、cs.CL

Comments Neurips 25, Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17788 2025-09-23 cs.CL cs.AI 62%

One Agent to Serve All: a Lite-Adaptive Stylized AI Assistant for Millions of Multi-Style Official Accounts

Xingyu Fan, Feifei Li, Wenhui Que, Hailong Li

专题命中 知识库问答 :RAG(abstract);分类 cs.CL、cs.AI

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01606 2025-09-23 cs.CL cs.AI cs.CY cs.LG 62%

Beyond Prompting: An Efficient Embedding Framework for Open-Domain Question Answering

Zhanghao Hu, Hanqi Yan, Qinglin Zhu, Zhenyi Shen, Yulan He, Lin Gui

机构 * King’s College London(伦敦国王学院) The Alan Turing Institute(艾伦·图灵研究所)

专题命中 知识库问答 :retriever(abstract);分类 cs.CL、cs.AI

Comments Accepted in ACL 2025 Main, Project link: https://zhanghao-acl25-embqa.github.io/ACL2025-EmbQA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04696 2025-09-08 cs.CL cs.AI 62%

ODKE+: Ontology-Guided Open-Domain Knowledge Extraction with LLMs

Samira Khorshidi, Azadeh Nikfarjam, Suprita Shankar, Yisi Sang, Yash Govind, Hyun Jang, Ali Kasgari, Alexis McClimans, Mohamed Soliman, Vishnu Konda, Ahmed Fakhry, Xiaoguang Qi

机构 * Apple Inc(苹果公司)

专题命中 知识库问答 :retriever(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12746 2025-09-03 cs.CL cs.AI 62%

EvidenceMap: Learning Evidence Analysis to Unleash the Power of Small Language Models for Biomedical Question Answering

Chang Zong, Jian Wan, Siliang Tang, Lei Zhang

机构 * Zhejiang University of Science and Technology(浙江理工大学) Zhejiang University(浙江大学)

专题命中 知识库问答 :RAG(abstract);分类 cs.CL、cs.AI

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10522 2025-07-15 cs.AI cs.CL cs.MA 62%

DeepResearch$^{\text{Eco}}$: A Recursive Agentic Workflow for Complex Scientific Question Answering in Ecology

Jennifer D'Souza, Endres Keno Sander, Andrei Aioanei

机构 * TIB Leibniz Information Centre for Science(图灵-莱比锡科学与技术信息中心) Leibniz University Hannover, Germany(莱比锡汉诺威大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20476 2025-06-26 cs.CL cs.IR 62%

Knowledge-Aware Diverse Reranking for Cross-Source Question Answering

Tong Zhou

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 知识库问答 :RAG(abstract);分类 cs.IR、cs.CL

Journal ref SIGIR 2025 LiveRAG

详情

展开后加载摘要…

URL PDF HTML 收藏