arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 385 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 长文档RAG 385 篇

2508.12800 2025-09-01 cs.CL cs.AI 73%

Atom-Searcher: Enhancing Agentic Deep Research via Fine-Grained Atomic Thought Reward

Yong Deng, Guoqing Wang, Zhenzhe Ying, Xiaofeng Wu, Jinzhen Lin, Wenwen Xiong, Yuqin Dai, Shuo Yang, Zhanwei Zhang, Qiwen Wang, Yang Qin, Yuan Wang, Quanxing Zha, Sunhao Dai, Changhua Meng

机构 * Ant Group(蚂蚁集团)

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11932 2025-05-20 cs.CL cs.IR 73%

Neuro-Symbolic Query Compiler

Yuyao Zhang, Zhicheng Dou, Xiaoxi Li, Jiajie Jin, Yongkang Wu, Zhonghua Li, Qi Ye, Ji-Rong Wen

机构 * Renmin University of China(中国人民大学) Huawei Poisson Lab(华为Poisson实验室)

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.CL

Comments Findings of ACL2025, codes are available at this url: https://github.com/YuyaoZhangQAQ/Query_Compiler

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19413 2025-04-29 cs.CL cs.AI 73%

Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory

Prateek Chhikara, Dev Khant, Saket Aryan, Taranjeet Singh, Deshraj Yadav

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.05591 2025-04-10 cs.CL cs.AI 73%

MemoRAG: Boosting Long Context Processing with Global Memory-Enhanced Retrieval Augmentation

Hongjin Qian, Zheng Liu, Peitian Zhang, Kelong Mao, Defu Lian, Zhicheng Dou, Tiejun Huang

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments theWebConf 2025. Codes and models are in https://github.com/qhjqhj00/MemoRAG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09906 2025-03-04 cs.CL cs.AI cs.LG 73%

Generative Representational Instruction Tuning

Niklas Muennighoff, Hongjin Su, Liang Wang, Nan Yang, Furu Wei, Tao Yu, Amanpreet Singh, Douwe Kiela

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments 67 pages (16 main), 25 figures, 34 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01449 2025-03-03 cs.IR cs.CL cs.CV 73%

ColPali: Efficient Document Retrieval with Vision Language Models

Manuel Faysse, Hugues Sibille, Tony Wu, Bilel Omrani, Gautier Viaud, Céline Hudelot, Pierre Colombo

专题命中 长文档RAG :retrieval augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.CL

Comments Published as a conference paper at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10198 2025-02-10 cs.CL cs.AI 73%

ClashEval: Quantifying the tug-of-war between an LLM's internal prior and external evidence

Kevin Wu, Eric Wu, James Zou

专题命中 长文档RAG :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments Revised June 9 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13101 2025-01-31 cs.CL cs.AI 73%

Retrieve, Summarize, Plan: Advancing Multi-hop Question Answering with an Iterative Approach

Zhouyu Jiang, Mengshu Sun, Lei Liang, Zhiqiang Zhang

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments Accepted by WWW2025 Agent4IR Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14831 2025-01-15 cs.CL cs.AI 73%

HippoRAG: Neurobiologically Inspired Long-Term Memory for Large Language Models

Bernal Jiménez Gutiérrez, Yiheng Shu, Yu Gu, Michihiro Yasunaga, Yu Su

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments NeurIPS 2024. Code and data: https://github.com/OSU-NLP-Group/HippoRAG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13070 2024-10-18 cs.CL cs.IR 73%

Is Semantic Chunking Worth the Computational Cost?

Renyi Qu, Ruixuan Tu, Forrest Bao

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10930 2024-10-08 cs.CL cs.AI cs.LG 73%

Fine-Tuning and Prompt Optimization: Two Great Steps that Work Better Together

Dilara Soylu, Christopher Potts, Omar Khattab

专题命中 长文档RAG :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18312 2024-08-29 cs.CL cs.AI 73%

AI-native Memory: A Pathway from LLMs Towards AGI

Jingbo Shang, Zai Zheng, Jiale Wei, Xiang Ying, Felix Tao, Mindverse Team

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16008 2024-07-04 cs.CL cs.AI cs.LG 73%

Found in the Middle: Calibrating Positional Attention Bias Improves Long Context Utilization

Cheng-Yu Hsieh, Yung-Sung Chuang, Chun-Liang Li, Zifeng Wang, Long T. Le, Abhishek Kumar, James Glass, Alexander Ratner, Chen-Yu Lee, Ranjay Krishna, Tomas Pfister

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments ACL Findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17526 2024-06-26 cs.CL cs.IR 73%

LumberChunker: Long-Form Narrative Document Segmentation

André V. Duarte, João Marques, Miguel Graça, Miguel Freire, Lei Li, Arlindo L. Oliveira

专题命中 长文档RAG :RAG(abstract);dense retrieval(abstract);分类 cs.IR、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.10423 2022-12-21 cs.IR cs.CL 73%

Fine-Grained Distillation for Long Document Retrieval

Yucheng Zhou, Tao Shen, Xiubo Geng, Chongyang Tao, Guodong Long, Can Xu, Daxin Jiang

专题命中 长文档RAG :retriever(abstract);dense retrieval(abstract);分类 cs.IR、cs.CL

Comments 13 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07493 2025-08-26 cs.CV 71%

VisR-Bench: An Empirical Study on Visual Retrieval-Augmented Generation for Multilingual Long Document Understanding

Jian Chen, Ming Li, Jihyung Kil, Chenguang Wang, Tong Yu, Ryan Rossi, Tianyi Zhou, Changyou Chen, Ruiyi Zhang

专题命中 长文档RAG :retrieval-augmented generation(title)

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13730 2026-08-17 cs.SE cs.AI cs.LG 新提交 70%

Building AI-Intensive Software with AI: Early Results and a Cautionary Tale on Measuring Development Cost

用AI构建AI密集型软件:早期成果及关于测量开发成本的警示故事

Victor Barros de Miranda Neves, Kiev Santos da Gama, Vinicius Cardoso Garcia

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 本文通过六人学生团队用AI构建对话式入职助手的案例研究,修正了AI密集型软件开发成本测量的两个常见错误,得出修正后的成本比率约为9.9倍,并提出需建立更稳健的成本核算方法。

Comments 4 pages, 2 figures, Accepted for publication at the International Workshop on Intelligent Software Engineering (ISE 2026) @ CBSoft 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00003 2026-08-04 cs.AI 新提交 70%

AutoFOAM: The Self-Refining Autonomous OpenFOAM Agent

AutoFOAM:自优化自主OpenFOAM智能体

Arun Govind Neelan, A Seshaditya

机构 * SimuNetics Onnes Cryogenics Quasi AI

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 AutoFOAM是基于Qwen-coder 2.5-14B微调的自主LLM智能体,通过7阶段迭代循环及三种抗退化机制,可基于自然语言指令完成OpenFOAM模拟,助力CFD工作流程普及与快速原型开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22157 2026-07-27 cs.AI 新提交 70%

Learning on the Job: Continual Learning from Deployment Feedback for Frozen-Weights Agents

在职学习:从部署反馈中对冻结权重智能体进行持续学习

Valentin Tablan, Scott Taylor, Kristoffer Bernhem

机构 * The Memory Company(记忆公司)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 研究人工智能冻结权重智能体如何从部署反馈中持续学习,核心方法是将冻结模型与外部记忆配对,主要贡献是通过该方法在银行领域任务中提升成功率,解决多个基线未解决任务,且结果可跨模型,记忆可迁移,相关内容已发布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21604 2026-07-27 cs.AI 新提交 70%

AgentKVShift: Efficient KV Cache Reuse for Agentic Memory Systems

AgentKVShift:用于智能体记忆系统的高效KV缓存重用

Nilesh Prasad Pandey, Jason Kong, Lanxiang Hu, Quanling Zhao, Yujie Zhao, Onat Gungor, Hao Zhang, Tajana Rosing

机构 * University of California, San Diego(加利福尼亚大学圣地亚哥分校)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 研究针对内存增强语言模型智能体推理成本高的问题,提出无训练、探针引导的AgentKVShift方法,通过估计内存级偏移量校正重用令牌,在多语言模型和基准测试中表现出色,实现低重新计算量和预填充加速,还能与缓存量化正交组合提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04144 2026-07-15 cs.AI 版本更新 70%

RippleBench: Capturing Ripple Effects Using Existing Knowledge Repositories

RippleBench: 利用现有知识库捕捉涟漪效应

Roy Rinberg, Usha Bhalla, Igor Shilov, Flavio P. Calmon, Rohit Gandikota

机构 * Harvard University(哈佛大学) Imperial College London(伦敦帝国学院) Northeastern University(东北大学)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 提出RippleBench-Maker自动管道,从知识库检索语义邻居生成选择题,评估八种遗忘方法在Llama3-8B-Instruct上的涟漪效应,发现准确率下降随语义距离衰减且跨模型一致。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07740 2026-07-13 cs.LG cs.AI 新提交 70%

Jet-Long: Efficient Long-Context Extension with Dynamic Bifocal RoPE

Jet-Long:使用动态双焦点旋转位置编码的高效长上下文扩展

Haozhan Tang, Zerui Wang, Yuxian Gu, Song Han, Han Cai

机构 * NVIDIA(英伟达)

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 研究针对现代语言模型长上下文应用中零样本上下文扩展问题,提出Jet-Long方法,通过动态双焦点RoPE及相关技术,在推理时开销小,在多种模型和基准测试中表现优异,还能推广到其他架构且超参数弹性强。

Comments added discussion of AdaGroPE and LaMPE (Findings of ACL 2026) with clarified contribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00331 2026-07-10 cs.AI cs.MA 70%

CogEvo-Edu: Cognitive Evolution Educational Multi-Agent Collaborative System

CogEvo-Edu: 基于认知进化教育的多智能体协作系统

Yefeng Wu, Yuchen Song, Yecheng Zhao, Ling Wu, Shan Wan

机构 * Electronic Science and Technology, Anhui University(安徽大学电子科学与技术学院) Medical Imaging Science, Wannan Medical College(皖南医学院医学影像学院)

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 CogEvo-Edu通过认知进化机制实现教育多智能体协作,提升数字信号处理教学效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28666 2026-06-30 cs.CR cs.AI 70%

Why Trust Your Agent? Empirical Security Gains from TRiSM-Guided Agentic Workflows in Healthcare

为何信任你的智能体?医疗保健中TRiSM引导的智能体工作流的实证安全增益

Liam Kearns

机构 * AuraQ

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 本文应用AI信任、风险与安全管理(TRiSM)框架,将不安全的医疗报告生成智能体工作流转变为安全敏感的工作流,在五种大语言模型上评估,将平均攻击成功率从31%-42%降至10%-25%,同时报告准确率提升14个百分点。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28409 2026-06-30 cs.AR cs.AI 70%

Evidence-Driven LLM Agent for C-to-Synthesizable-C Conversion and Verification

证据驱动的LLM智能体用于C到可综合C的转换与验证

Zhe Zhao, Hongbing Lang, Zhihan Xiao, Luke Ztz Hu, John Imoleayo Adebisi, Songping Mai

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 提出一种基于大语言模型的闭环生成-验证-诊断-修复框架,通过四阶段验证器、渐进式不匹配定位链和证据检索增强生成,将C代码转换为HLS可综合C,显著优于现有方法。

Comments 14 pages, 8 figures, submitted to IEEE Transactions on Computer-Aided Design of Integrated Circuits and Systems (TCAD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23108 2026-06-23 cs.AI 新提交 70%

TTFT-Aware Graph Chain-of-Thought:Distance-Indexed Neural A* for Low-Hallucination Multi-Hop Medical Reasoning

TTFT感知的图链式思维:用于低幻觉多跳医学推理的距离索引神经A*

Bechir Dardouri, Kaïs Zhioua, Yassine Msaddak

机构 * Tanit Healthcare Technologies, Tunisia(突尼斯塔尼特医疗技术公司)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 提出一种生产级GraphRAG框架,通过距离索引的神经A*算法在医学知识图谱中导航,结合PLL精确距离和AStarNet启发式,实现低延迟、低幻觉的多跳推理,并改善首令牌时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22963 2026-06-23 cs.CR cs.AI 版本更新 70%

When Compression Becomes an Attack Surface: Black-Box Attacks on Prompt-Compressed LLM Agents

当压缩成为攻击面:针对提示压缩的LLM智能体的黑盒攻击

Zesen Liu, Zhixiang Zhang, Yuchong Xie, Dongdong She

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 提出当可信与不可信输入共享压缩预算时,攻击者可通过扰动不可信输入导致压缩器丢弃关键证据或安全护栏,并设计黑盒攻击COMA,平均攻击成功率达0.71。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17637 2026-06-17 cs.AI 新提交 70%

Brick-DICL: Dynamic In-Context Learning for Automated Brick Schema Classification

Brick-DICL:用于自动化Brick模式分类的动态上下文学习

Yiyue Qian, Shinan Zhang, Huan Song, Negin Sokhandan, Hannah Marlowe, Diego Socolinsky

机构 * Amazon AWS Generative AI Innovation Center(亚马逊AWS生成式AI创新中心)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 提出Brick-DICL两阶段动态上下文学习框架,通过元数据检索和类别检索增强大语言模型领域知识,结合多模型过滤机制,实现楼宇管理系统点位的自动化Brick分类,显著提升准确率并减少人工验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08539 2026-06-09 cs.AI 新提交 70%

AgentTrust: A Self-Improving Trust Layer for AI-Agent Actions

AgentTrust: AI代理行为的自改进信任层

Chenglin Yang

机构 * Independent Researcher(独立研究员)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 提出AgentTrust v2,通过威胁类型分类(词汇/语义)和自学习机制,在代理行为中实现自改进信任决策,显著提升语义威胁检测准确率并降低误拦。

Comments 29 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06090 2026-06-05 cs.AI 70%

Beyond Semantic Organization: Memory as Execution State Management for Long-Horizon Agents

超越语义组织:记忆作为长时程智能体的执行状态管理

Yaoqi Chen, Haibin Lai, Yuru Feng, Chuyu Han, Qianxi Zhang, Baotong Lu, Menghao Li, Xinjiang Wang, Zhirui Wang, Shusen Xu, Zengzhong Li, Zewen Jin, Hao Wu, Cheng Li, Qi Chen

机构 * University of Science and Technology of China(中国科学技术大学) Microsoft(微软) Nanjing University(南京大学) University of California, San Diego(加州大学圣地亚哥分校)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 针对长时程任务中智能体依赖执行状态而非语义相似性的问题,提出MAGE(记忆作为智能体引导的探索),通过层次状态树管理交互,实现状态完整性和错误隔离,在MemoryArena上任务成功率提升7.8-20.4个百分点,token消耗降低55.1%。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏