arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 8572 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 知识库问答 545 篇

2607.28126 2026-08-11 cs.AI 版本更新 57%

ConMem: Contribution-Aware Memory for Long-Horizon Manufacturing Inspection Logs

ConMem:面向长周期制造检查日志的贡献感知记忆

Bingchen Liu, Yuanyuan Fang, Lei Liu, Guangyuan Dong, Xing Fu, Yuanyuan Gao, Shuyue Wei, Xin Li, Xiangtian Meng

机构 * Shandong University(山东大学) Boston University(波士顿大学) North China Electric Power University(华北电力大学) National University of Singapore(新加坡国立大学) Joint SDU-NTU Centre for Artificial Intelligence Research (C-FAIR), Shandong University(山东大学-南洋理工大学人工智能联合研究中心(C-FAIR)) Rizhao Steel Holding Group Co., Ltd.(日照钢铁控股集团有限公司)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 该研究针对长周期制造检查日志的早期风险筛查需求,提出ConMem贡献感知记忆框架,通过Shapley风格评估保留高价值证据,在真实数据集上实现76.0% QA准确率,大幅减少输入token数与响应时间,可有效保留弱早期信号并提供预警。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23278 2026-07-28 cs.CL cs.MA 新提交 57%

Co-Evolving Graph and Text Memory for Training-Free Multi-Hop Question Answering

用于无训练多跳问答的协同进化图与文本记忆

Hieu Man, Thien Huu Nguyen

机构 * University of Oregon(俄勒冈大学)

专题命中 知识库问答 :RAG(abstract);分类 cs.CL

AI总结 研究多跳问答中协调关系与文本证据问题,提出基于同步双向图-文本工作记忆的无训练系统Co-E,通过同步周期巩固记忆并注入事实,在多跳问答基准测试中表现出色,优于可比基线且与其他系统有竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17547 2026-06-16 cs.CV cs.IR cs.MM 版本更新 57%

A Comprehensive Survey of Knowledge-Based Vision Question Answering Systems: The Lifecycle of Knowledge in Visual Reasoning Task

基于知识的视觉问答系统综述:视觉推理任务中的知识生命周期

Jiaqi Deng, Zonghan Wu, Huan Huo, Guandong Xu

机构 * University Technology of Sydney(悉尼大学技术学院) East China Normal University(华东师范大学) Education University of Hong Kong(香港教育大学)

专题命中 知识库问答 :knowledge retrieval(abstract);分类 cs.IR

AI总结 综述基于知识的视觉问答(KB-VQA)方法,将其分为知识表示、检索和推理三个阶段,并探讨大语言模型带来的变革,指出未来研究方向。

Comments Accepted at TKDE, 20 pages, 5 figures, 4 tables

Journal ref IEEE Transactions on Knowledge and Data Engineering, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19309 2026-06-05 cs.CL 57%

How Do Document Parsers Break? Auditing Structural Vulnerability in Document Intelligence

文档解析器如何失效?审计文档智能中的结构脆弱性

Yue Chen, Yihao Wang, Ziyi Tang, Yongsen Zheng, Keze Wang

机构 * Sun Yat-sen University(中山大学) Nanyang Technological University(南洋理工大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文提出ProSA框架,通过解耦控制探测、策略驱动目标和结构感知诊断,审计文档布局分析(DLA)管道中的结构脆弱性,发现块级结构损失率(B-SLR)比受影响面积更能反映OCR不稳定性,且结构探测导致更大的下游QA/检索退化。

Comments 18 pages, 5 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22811 2026-05-22 cs.DB 57%

GS-QA: A Benchmark for Geospatial Question Answering

GS-QA:一个地理空间问答的基准测试

Majid Saeedan, Muhammad Shihab Rashid, Ahmed Eldawy, Vagelis Hristidis

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.DB

AI总结 本文提出GS-QA基准测试,用于评估地理空间问答系统,通过结合多个来源的信息,涵盖广泛的空间对象、谓词和答案类型,展示了现有方法在处理复杂空间谓词和多源推理时的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00798 2026-04-23 cs.CV cs.AI 57%

Progressive Multimodal Search and Reasoning for Knowledge-Intensive Visual Question Answering

逐步多模态搜索与推理用于知识密集型视觉问答

Changin Choi, Wonseok Lee, Jungmin Ko, Wonjong Rhee

机构 * Interdisciplinary Program in Artificial Intelligence(人工智能交叉学科项目) Department of Intelligence and Information(智能与信息系) Samsung Advanced Institute of Technology(三星先进技术研究院)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 本文提出PMSR框架,通过逐步构建结构化推理轨迹提升知识获取与综合能力,实验显示在六个基准测试中提升了检索召回率和端到端回答准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22683 2026-04-10 cs.CV cs.AI 57%

SUPERGLASSES: Benchmarking Vision Language Models as Intelligent Agents for AI Smart Glasses

SUPERGLASSES:基于智能眼镜的视觉语言模型智能体基准测试

Zhuohang Jiang, Xu Yuan, Haohao Qu, Shanru Lin, Kanglong Liu, Wenqi Fan, Qing Li

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 知识库问答 :knowledge retrieval(abstract);分类 cs.AI

AI总结 本文提出SUPERGLASSES基准,通过真实世界数据评估智能眼镜的多模态交互能力,提出SUPERLENS模型在VQA任务中超越GPT-4o,揭示了任务特定解决方案的重要性。

Journal ref 2026 IEEE/CVF Conference on Computer Vision and Pattern Recognition- FINDINGS Track (CVPRF)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26567 2026-04-07 cs.SE cs.AI 57%

Beyond Code Snippets: Benchmarking LLMs on Repository-Level Question Answering

超越代码片段:在仓库层面评估大语言模型的问答任务

Yoseph Berhanu Alebachew, Hunter Leary, Swanand Vaishampayan, Chris Brown

机构 * Department of Computer Science, Virginia Tech(弗吉尼亚理工大学计算机科学系)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 本文提出StackRepoQA数据集,用于评估大语言模型在多项目仓库层面的问答能力,通过对比不同配置下的性能,揭示了模型在处理仓库级程序理解时的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18516 2026-03-20 cs.IR 57%

Total Recall QA: A Verifiable Evaluation Suite for Deep Research Agents

全面回忆问答:深度研究代理的可验证评估套件

Mahta Rafiee, Heydar Soudani, Zahra Abbasiantaeb, Mohammad Aliannejadi, Faegheh Hasibi, Hamed Zamani

专题命中 知识库问答 :retriever(abstract);分类 cs.IR

AI总结 本文提出Total Recall QA评估框架,通过结构化知识库和文本语料构建精准查询,建立基于Wikidata-Wikipedia和合成电商知识库的基准测试,评估深度研究代理的检索与生成能力。

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17668 2026-03-19 cs.DB 57%

Halo: Domain-Aware Query Optimization for Long-Context Question Answering

Halo:面向长上下文问题回答的领域感知查询优化

Pramod Chunduri, Francisco Romero, Ali Payani, Kexin Rong, Joy Arulraj

专题命中 知识库问答 :RAG(abstract);分类 cs.DB

AI总结 Halo通过自动提取领域知识并应用于多阶段查询流程,提升长上下文问题回答的准确性和效率,实验表明其在金融、文献和科学数据集上准确率提升13%,成本降低4.8倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15723 2026-03-18 cs.AI 57%

Context-Length Robustness in Question Answering Models: A Comparative Empirical Study

问答模型中的上下文长度鲁棒性:一项比较实证研究

Trishita Dhara, Siddhesh Sheth

机构 * Upper Hand Ace Rent a Car

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 研究通过SQuAD和HotpotQA基准评估问答模型在上下文长度变化下的鲁棒性,发现多跳推理任务比单跨度提取任务更易受上下文稀释影响。

Comments Accepted for Oral Presentation at Math AI 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07950 2026-03-10 cs.DB 57%

Decomposition-Driven Multi-Table Retrieval and Reasoning for Numerical Question Answering

基于分解的多表检索与推理用于数值问题回答

Feng Luo, Hai Lan, Hui Luo, Zhifeng Bao, Xiaoli Wang, J. Shane Culpepper, Shazia Sadiq

专题命中 知识库问答 :retriever(abstract);分类 cs.DB

AI总结 本文提出DMRAL框架,通过构建表关系图和子问题引导推理器,有效解决大规模表集合中的多表检索与推理问题,提升答案准确性。

Comments This is the technical report for the ICDE 2026 paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09817 2026-02-11 cs.CL cs.DL 57%

AnalyticsGPT: An LLM Workflow for Scientometric Question Answering

AnalyticsGPT: 一个基于大语言模型的科学度量问答工作流

Khang Ly, Georgios Cheirmpos, Adrian Raudaschl, Christopher James, Seyed Amin Tabatabaei

机构 * Elsevier B.V.(埃塞尔弗斯有限公司)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 AnalyticsGPT通过LLM实现科学度量问答,结合检索增强生成和代理概念,提升科学数据分析效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15476 2026-01-23 cs.AI cs.PF 57%

Reliability by design: quantifying and eliminating fabrication risk in LLMs. From generative to consultative AI: a comparative analysis in the legal domain and lessons for high-stakes knowledge bases

可靠性设计:量化并消除大语言模型中的制造风险。从生成式到咨询式AI:法律领域中的比较分析及对高风险知识库的启示

Alex Dantart

机构 * Humanizing Internet

专题命中 知识库问答 :RAG(abstract);分类 cs.AI

AI总结 本文提出通过减少幻觉提升大语言模型在法律领域的可靠性,引入两种可靠性指标,并展示先进的 RAG 系统有效降低伪造事实率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14465 2026-01-22 cs.AI 57%

Context-Picker: Dynamic context selection using multi-stage reinforcement learning

Context-Picker: 基于多阶段强化学习的动态上下文选择

Siyuan Zhu, Chengdong Xu, Kaiqiang Ke, Chao Yu

机构 * Sun Yat-sen University(中山大学)

专题命中 知识库问答 :RAG(abstract);分类 cs.AI

AI总结 Context-Picker通过多阶段强化学习动态选择上下文,提升长上下文问答的准确率和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13630 2026-01-21 cs.CL 57%

Activation-Space Anchored Access Control for Multi-Class Permission Reasoning in Large Language Models

基于激活空间锚定的多类权限推理访问控制

Zhaopeng Zhang, Pengcheng Sun, Lan Zhang, Chen Tang, Jiewei Lai, Yunhao Wang, Hui Jin

机构 * University of Science and Technology of China(中国科学技术大学) Lenovo Research(联想研究院)

专题命中 知识库问答 :knowledge retrieval(abstract);分类 cs.CL

AI总结 本文提出AAAC框架,通过激活空间锚点实现多类权限控制,有效降低权限违规和攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21318 2026-01-08 cs.AI 57%

Beyond Chemical QA: Evaluating LLM's Chemical Reasoning with Modular Chemical Operations

超越化学问答:利用模块化化学操作评估LLM的化学推理

Hao Li, He Cao, Bin Feng, Yanjun Shao, Xiangru Tang, Zhiyuan Yan, Li Yuan, Yonghong Tian, Yu Li

机构 * Pengcheng Laboratory(鹏城实验室) International Digital Economy Academy(国际数字经济学院) School of Electronic and Computer Engineering, Peking University(北京大学电子与计算机工程学院) School of AI for Science, Peking University(北京大学科学人工智能学院) Yale University(耶鲁大学)

专题命中 知识库问答 :knowledge retrieval(abstract);分类 cs.AI

AI总结 本文提出ChemCoTBench框架,通过模块化化学操作评估LLM在化学推理中的能力,解决分子优化和反应预测等复杂任务。

Comments Accepted by NeurIPS 2025 Dataset Track, 22 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00536 2026-01-05 cs.CL 57%

Retrieval--Reasoning Processes for Multi-hop Question Answering: A Four-Axis Design Framework and Empirical Trends

多跳问答中的检索-推理过程:一种四维设计框架和实证趋势

Yuelyu Ji, Zhuochun Li, Rui Meng, Daqing He

机构 * School of Computing and Information, University of Pittsburgh(计算与信息学院,匹兹堡大学) Google Cloud AI Research(谷歌云人工智能研究)

专题命中 知识库问答 :RAG(abstract);分类 cs.CL

AI总结 本文提出四维设计框架,分析多跳问答系统中检索-推理过程的执行计划、索引结构、控制策略和停止标准,揭示有效性、效率与证据忠实度的权衡,并指出结构感知规划、可转移控制策略和鲁棒停止是未来挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14121 2025-12-22 cs.CV cs.AI 57%

SportsGPT: An LLM-driven Framework for Interpretable Sports Motion Assessment and Training Guidance

SportsGPT: 一种基于大语言模型的可解释性体育动作评估与训练指导框架

Wenbo Tian, Ruting Lin, Hongxian Zheng, Yaodong Yang, Geng Wu, Zihao Zhang, Zhang Zhang

机构 * School of Artificial Intelligence, UCAS, Beijing, China(人工智能学院) MAIS, NLPR, Institute of Automation, CAS, Beijing, China(自动化研究所) College of Education, Beijing Sport University, Beijing, China(北京体育大学) KuTi Sports Technology, Shaanxi, China(KuTi体育科技) Haoxiong Technology, Shanghai, China(浩鸿科技)

专题命中 知识库问答 :RAG(abstract);分类 cs.AI

AI总结 SportsGPT通过结合大语言模型和运动分析技术,实现可解释的体育动作评估与专业训练指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18434 2025-11-18 cs.CL 57%

Chain-of-Conceptual-Thought Elicits Daily Conversation in Large Language Models

Qingqing Gu, Dan Wang, Yue Zhao, Xiaoyu Wang, Zhonglin Jiang, Yong Chen, Hongyan Li, Luo Ji

机构 * Geely AI Lab(Geely人工智能实验室) Beijing Institute of Technology(北京理工大学)

专题命中 知识库问答 :RAG(abstract);分类 cs.CL

Comments PRICAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21866 2025-10-28 cs.AI 57%

Capability Ceilings in Autoregressive Language Models: Empirical Evidence from Knowledge-Intensive Tasks

Javier Marín

专题命中 知识库问答 :knowledge retrieval(abstract);分类 cs.AI

Comments The experiments in this paper were performed in January 2024. Current model architectures are considerably more complex than those presented here

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03000 2025-10-10 cs.IR 57%

SustainableQA: A Comprehensive Question Answering Dataset for Corporate Sustainability and EU Taxonomy Reporting

Mohammed Ali, Abdelrahman Abdallah, Adam Jatowt

专题命中 知识库问答 :RAG(abstract);分类 cs.IR

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22490 2025-09-29 cs.CL 57%

JGU Mainz's Submission to the WMT25 Shared Task on LLMs with Limited Resources for Slavic Languages: MT and QA

Hossain Shaikh Saadi, Minh Duc Bui, Mario Sanz-Guerrero, Katharina von der Wense

机构 * Johannes Gutenberg University Mainz(莱茵河畔明斯特约翰·格门特大学) University of Colorado Boulder(科罗拉多大学波尔德分校)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.CL

Comments WMT 25 Shared Task LLMs with Limited Resources for Slavic Languages: MT and QA

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20953 2025-09-26 cs.AI 57%

Beyond Stars: Bridging the Gap Between Ratings and Review Sentiment with LLM

Najla Zuhir, Amna Mohammad Salim, Parvathy Premkumar, Moshiur Farazi

机构 * College of Computing & Information Technology University of Doha for Science and Technology(计算与信息科技学院 优德科技大学)

专题命中 知识库问答 :RAG(abstract);分类 cs.AI

Comments Paper accepted for presentation at ACS/IEEE 22nd International Conference on Computer Systems and Applications (AICCSA 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11474 2025-09-23 cs.CL 57%

Med-PRM: Medical Reasoning Models with Stepwise, Guideline-verified Process Rewards

Jaehoon Yun, Jiwoong Sohn, Jungwoo Park, Hyunjae Kim, Xiangru Tang, Yanjun Shao, Yonghoe Koo, Minhyeok Ko, Qingyu Chen, Mark Gerstein, Michael Moor, Jaewoo Kang

机构 * Korea University(韩国大学) ETH Zürich(苏黎世联邦理工学院) Yale University(耶鲁大学) AIGEN Sciences(AIGEN公司) Hanyang University College of Medicine(翰雅大学医学院) University of Ulsan College of Medicine(釜山大学医学院)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.CL

Comments Accepted to EMNLP 2025 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09159 2025-09-12 cs.CV cs.AI 57%

A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering

Zhiyue Liu, Sihang Liu, Jinyuan Liu, Xinru Zhang

机构 * School of Computer, Electronics and Information(计算机、电子与信息学院) Guangxi University(广西大学) Guangxi Key Laboratory of Multimedia Communications and Network Technology(广西多媒体通信与网络技术重点实验室)

专题命中 知识库问答 :knowledge retrieval(abstract);分类 cs.AI

Comments Accepted by the IEEE International Conference on Multimedia and Expo (ICME 2025) for oral presentation. © 2025 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00572 2025-09-03 cs.HC cs.IR 57%

How to Make Museums More Interactive? Case Study of Artistic Chatbot

Filip J. Kucia, Bartosz Grabek, Szymon D. Trochimiak, Anna Wróblewska

专题命中 知识库问答 :RAG(abstract);分类 cs.IR

Comments 7 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17032 2025-08-25 cs.CL 57%

MINTQA: A Multi-Hop Question Answering Benchmark for Evaluating LLMs on New and Tail Knowledge

Jie He, Nan Hu, Wanqiu Long, Jiaoyan Chen, Jeff Z. Pan

机构 * School of Informatics, University of Edinburgh, UK(爱丁堡大学信息学院) Southeast University, Nanjing, Jiangsu, China(东南大学) University of Manchester, UK(曼彻斯特大学)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10861 2025-07-30 cs.CL 57%

Ai2 Scholar QA: Organized Literature Synthesis with Attribution

Amanpreet Singh, Joseph Chee Chang, Chloe Anastasiades, Dany Haddad, Aakanksha Naik, Amber Tanaka, Angele Zamarron, Cecile Nguyen, Jena D. Hwang, Jason Dunkleberger, Matt Latzke, Smita Rao, Jaron Lochner, Rob Evans, Rodney Kinney, Daniel S. Weld, Doug Downey, Sergey Feldman

机构 * Allen Institute for AI(Allen人工智能研究所)

专题命中 知识库问答 :retrieval-augmented generation(abstract);分类 cs.CL

Comments 7 pages

Journal ref ACL 2025 System Demonstrations pages 513-523 Vienna Austria

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09164 2025-07-23 cs.CR cs.AI 57%

ShadowCode: Towards (Automatic) External Prompt Injection Attack against Code LLMs

Yuchen Yang, Yiming Li, Hongwei Yao, Bingrun Yang, Yiling He, Tianwei Zhang, Dacheng Tao, Zhan Qin

机构 * State Key Laboratory of Blockchain and Data Security, Zhejiang University(区块链与数据安全国家重点实验室,浙江大学) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security, Hangzhou(杭州高新区(滨江)区块链与数据安全研究院,杭州) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

专题命中 知识库问答 :RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏