arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 385 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 长文档RAG 385 篇

2603.20218 2026-03-24 cs.CL cs.LG 57%

An experimental study of KV cache reuse strategies in chunk-level caching systems

基于块级缓存系统的KV缓存重用策略实验研究

Samuel Cestola, Tianxiang Xia, Zheng Weiyan, Zheng Pengfei, Diego Didona

专题命中 长文档RAG :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文通过实验探讨块级缓存系统中KV缓存重用策略的局限性与优化方法,提出一种融合现有技术的改进设计以提升准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20866 2026-03-19 cs.CR cs.AI 57%

AVIATOR: Towards AI-Agentic Vulnerability Injection Workflow for High-Fidelity, Large-Scale Code Security Dataset

AVIATOR:面向高保真、大规模代码安全数据集的AI代理漏洞注入流程

Amine Lbath, Massih-Reza Amini, Aurelien Delaitre, Vadim Okun

机构 * National Institute of Standards and Technology, Software and Systems Division(美国国家标准与技术研究院软件与系统 division) Université Grenoble Alpes, CNRS, LIG(格勒诺布尔阿尔卑斯大学,法国国家科学研究中心,LIG实验室)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 本文提出AVIATOR,首个AI代理漏洞注入框架,通过协调AI代理、工具分析和迭代自我纠正,生成高保真漏洞数据,提升漏洞检测模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15666 2026-03-18 cs.AI 57%

Compiled Memory: Not More Information, but More Precise Instructions for Language Agents

编译记忆:不是更多信息,而是为语言代理提供更精确的指令

James Rhodes, George Kang

机构 * AlphaBitCore, Inc.(AlphaBitCore公司)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 本文提出Atlas内存内核,通过编译积累的任务经验为语言代理生成指令结构,无需微调、RAG或人工干预,提升GPT-4o和Claude Sonnet~4.5在合同分析和多跳问答任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14229 2026-03-17 cs.AI cs.SE 57%

Agentic DAG-Orchestrated Planner Framework for Multi-Modal, Multi-Hop Question Answering in Hybrid Data Lakes

基于代理的DAG编排规划框架:用于混合数据湖中多模态、多跳问答系统

Kirushikesh D B, Manish Kesarwani, Nishtha Madaan, Sameep Mehta, Aldrin Dennis, Siddarth Ajay, Rakesh B R, Renu Rajagopal, Sudheesh Kairali

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 本文提出A.DOT规划框架,通过编译自然语言查询为DAG执行计划,实现多模态多跳问答,提升准确性和效率,并生成可追溯的证据链。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12963 2026-03-16 cs.CL 57%

Long-form RewardBench: Evaluating Reward Models for Long-form Generation

长文奖励基准:评估长文生成的奖励模型

Hui Huang, Yancheng He, Wei Liu, Muyun Yang, Jiaheng Liu, Kehai Chen, Bing Xu, Conghui Zhu, Hailong Cao, Tiejun Zhao

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

AI总结 本文提出Long-form RewardBench,首个专为长文生成设计的奖励模型评估平台,通过五个子任务评估20+主流模型,揭示分类与生成模型在长文奖励建模上的差异。

Comments Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09222 2026-03-11 cs.CL 57%

LooComp: Leverage Leave-One-Out Strategy to Encoder-only Transformer for Efficient Query-aware Context Compression

LooComp: 通过留一法策略提升仅编码器Transformer的查询感知上下文压缩效率

Thao Do, Dinh Phu Tran, An Vo, Seon Kwon Kim, Daeyoung Kim

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 长文档RAG :retrieval augmented generation(abstract);分类 cs.CL

AI总结 LooComp通过留一法策略提升仅编码器Transformer的查询感知上下文压缩效率,实现高效压缩与高吞吐量推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16974 2026-02-20 cs.IR 57%

Beyond Chunk-Then-Embed: A Comprehensive Taxonomy and Evaluation of Document Chunking Strategies for Information Retrieval

超越片段化后再嵌入:信息检索中文档片段化策略的全面分类与评估

Yongjie Zhou, Shuai Wang, Bevan Koopman, Guido Zuccon

专题命中 长文档RAG :dense retrieval(abstract);分类 cs.IR

AI总结 本文研究了文档片段化策略在信息检索中的分类与评估,发现任务依赖性和分段方法差异影响效果,提出统一框架并提供公开基准。

Comments Github link will be pushed later as it's anonymoused at the moment

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20659 2026-01-29 cs.CL cs.MA 57%

A Dialectic Pipeline for Improving LLM Robustness

辩证管道用于提升大语言模型鲁棒性

Sara Candussio

机构 * Università degli Studi di Trieste(特里埃斯特大学)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

AI总结 本文提出一种辩证管道,通过自我对话提升大语言模型的鲁棒性,有效减少幻觉并提高输出质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09631 2026-01-26 cs.CL 57%

LLMs Got Rhythm? Hybrid Phonological Filtering for Greek Poetry Rhyme Detection and Generation

LLMs Got Rhythm? 希腊诗歌押韵检测与生成的混合语音过滤

Stergios Chatzikyriakidis, Anastasia Natsina

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

AI总结 本文提出混合语音学算法与LLMs结合,解决希腊诗歌押韵检测与生成问题,通过验证循环提升性能至73.1%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16904 2026-01-19 cs.CR cs.CL 57%

How Good is Post-Hoc Watermarking With Language Model Rephrasing?

在语言模型重述中后置水印技术有多好?

Pierre Fernandez, Tom Sander, Hady Elsahar, Hongyan Chang, Tomáš Souček, Valeriu Lacatusu, Tuan Tran, Sylvestre-Alvise Rebuffi, Alexandre Mourachko

机构 * FAIR, Meta Superintelligence Labs(FAIR、Meta超智能实验室)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

AI总结 本文研究了语言模型重述中后置水印技术的效果,发现简单方法在某些情况下表现优异,但对可验证文本效果不佳。

Comments Code at https://github.com/facebookresearch/textseal

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10342 2026-01-16 cs.AI 57%

C-GRASP: Clinically-Grounded Reasoning for Affective Signal Processing

C-GRASP:基于临床的感知信号处理推理

Cheng Lin Cheng, Ting Chuan Lin, Chai Kai Chang

机构 * Department of Physics National Central University(物理系国立中央大学) Center for Education National Central University(教育中心国立中央大学)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 C-GRASP通过临床基础推理提升情感信号处理的准确性与临床一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09937 2026-01-16 cs.HC cs.IR 57%

From SERPs to Agents: A Platform for Comparative Studies of Information Interaction

从搜索结果页面到代理:一个用于信息交互比较研究的平台

Saber Zerhoudi, Michael Granitzer

专题命中 长文档RAG :RAG(abstract);分类 cs.IR

AI总结 UXLab是一个开源平台,用于比较信息交互系统,通过无代码实验设计支持多模态交互研究。

Journal ref Proceedings of the 2026 ACM SIGIR Conference on Human Information Interaction and Retrieval (CHIIR '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09760 2026-01-16 cs.SE cs.AI 57%

Investigating Tool-Memory Conflicts in Tool-Augmented LLMs

探究工具增强大语言模型中的工具-记忆冲突

Jiali Cheng, Rui Pan, Hadi Amiri

机构 * University of Massachusetts Lowell(马萨诸塞大学洛约拉分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 本文提出工具-记忆冲突的概念,发现现有LLMs在STEM任务中存在该问题,并评估了现有解决方法的不足。

Comments R2-FM Workshop @ ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16391 2025-12-19 cs.LG cs.AI cs.DC 57%

Kascade: A Practical Sparse Attention Method for Long-Context LLM Inference

Kascade:一种适用于长上下文LLM推理的实用稀疏注意力方法

Dhruv Deshmukh, Saurabh Goyal, Nipun Kwatra, Ramachandran Ramjee

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 Kascade是一种无需训练的稀疏注意力方法,通过锚定层计算Top-k索引并重用,实现长上下文LLM推理中的高效注意力处理。

Comments 11 pages, 8 figures, 3 tables and 1 algorithm

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19562 2025-12-05 quant-ph cs.AI 57%

PennyCoder: Efficient Domain-Specific LLMs for PennyLane-Based Quantum Code Generation

PennyCoder: 用于PennyLane量子代码生成的高效领域特定LLM

Abdul Basit, Minghao Shao, Muhammad Haider Asif, Nouhaila Innan, Muhammad Kashif, Alberto Marchisio, Muhammad Shafique

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

AI总结 PennyCoder是一种针对PennyLane量子编程的高效领域特定LLM,通过本地部署和低秩适应技术提升量子代码生成的准确性和效率。

Comments 6 pages, 5 figures, 3 tables, paper accepted to QCE 2025

Journal ref 2025 IEEE International Conference on Quantum Computing and Engineering (QCE), Albuquerque, NM, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02749 2025-11-05 cs.AI 57%

Using Span Queries to Optimize for Cache and Attention Locality

Paul Castro, Nick Mitchell, Nathan Ordonez, Thomas Parnell, Mudhakar Srivatsa, Antoni Viros i Martin

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

Comments 12 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25816 2025-10-31 cs.CL cs.LG 57%

Beyond Long Context: When Semantics Matter More than Tokens

Tarun Kumar Chawdhury, Jon D. Duke

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 长文档RAG :retrieval augmented generation(abstract);分类 cs.CL

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14900 2025-10-17 cs.AI cs.CR 57%

Mapping Smarter, Not Harder: A Test-Time Reinforcement Learning Agent That Improves Without Labels or Model Updates

Wen-Kwang Tsao, Yao-Ching Yu, Chien-Ming Huang

机构 * AI Lab, TrendMicro(趋势科技人工智能实验室)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13828 2025-10-17 cs.CL 57%

From Explainability to Action: A Generative Operational Framework for Integrating XAI in Clinical Mental Health Screening

Ratna Kandala, Akshata Kishore Moharir, Divya Arvinda Nayak

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04488 2025-10-07 cs.AI cs.IT math.IT 57%

Multi-Agent Collaborative Intelligence: Dual-Dial Control for Reliable LLM Reasoning

Edward Y. Chang, Ethan Y. Chang

机构 * Stanford University(斯坦福大学) UIUC(伊利诺伊大学香槟分校)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

Comments 27 pages, 5 figures, 21 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20625 2025-09-30 cs.CL 57%

Long Context Scaling: Divide and Conquer via Multi-Agent Question-driven Collaboration

Sibo Xiao, Zixin Lin, Wenyang Gao, Hui Chen, Yue Zhang

机构 * College of Computer Science, Zhejiang University(浙江大学计算机学院) NLP Lab, Westlake University(西湖大学自然语言处理实验室)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21848 2025-09-29 cs.LG cs.AI 57%

Graph of Agents: Principled Long Context Modeling by Emergent Multi-Agent Collaboration

Taejong Joo, Shu Ishida, Ivan Sosnovik, Bryan Lim, Sahand Rezaei-Shoshtari, Adam Gaier, Robert Giaquinto

机构 * Department of Industrial Engineering & Management Sciences, Northwestern University(工业工程与管理科学系,西北大学) Autodesk Research(Autodesk研究)

专题命中 长文档RAG :retrieval-augmented generation(abstract);分类 cs.AI

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08903 2025-09-12 cs.CL 57%

Noise or Nuance: An Investigation Into Useful Information and Filtering For LLM Driven AKBC

Alex Clay, Ernesto Jiménez-Ruiz, Pranava Madhyastha

机构 * City St George's, University of London(伦敦城市圣乔治大学) The Alan Turing Institute, British Library(艾伦·图灵研究所,大英图书馆)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

Comments 8 pages, 1 figure, accepted to the ISWC 2025 LM-KBC Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17852 2025-07-25 cs.MA cs.AI 57%

Technical Implementation of Tippy: Multi-Agent Architecture and System Design for Drug Discovery Laboratory Automation

Yao Fehlis, Charles Crain, Aidan Jensen, Michael Watson, James Juhasz, Paul Mandel, Betty Liu, Shawn Mahon, Daren Wilson, Nick Lynch-Jonely, Ben Leedom, David Fuller

机构 * Artificial, Inc.(Artificial公司)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19466 2025-06-30 cs.AI 57%

KunLunBaizeRAG: Reinforcement Learning Driven Inference Performance Leap for Large Language Models

Cheng Li, Jiexiong Liu, Yixuan Chen, Qihang Zhou, KunLun Meta

机构 * KunLun Meta(昆仑元)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04202 2025-06-27 cs.CR cs.AI cs.LG 57%

TracLLM: A Generic Framework for Attributing Long Context LLMs

Yanting Wang, Wei Zou, Runpeng Geng, Jinyuan Jia

机构 * Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

Comments To appear in USENIX Security Symposium 2025. The code and data are at: https://github.com/Wang-Yanting/TracLLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02483 2025-06-04 cs.CL 57%

Enhancing Large Language Models with Neurosymbolic Reasoning for Multilingual Tasks

Sina Bagheri Nezhad, Ameeta Agrawal

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

Comments Accepted at 19th Conference on Neurosymbolic Learning and Reasoning (NeSy 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10382 2025-05-29 cs.RO cs.AI cs.MA cs.SY eess.SY math.OC 57%

Communication- and Computation-Efficient Distributed Submodular Optimization in Robot Mesh Networks

Zirui Xu, Sandilya Sai Garimella, Vasileios Tzoumas

机构 * Department of Aerospace Engineering, University of Michigan(密歇根大学航空航天工程系) Institute for Robotics and Intelligent Machines, Georgia Institute of Technology(佐治亚理工学院机器人与智能机器研究所) Department of Robotics, University of Michigan(密歇根大学机器人学系)

专题命中 长文档RAG :RAG(abstract);分类 cs.AI

Comments Accepted to IEEE Transactions on Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18092 2025-05-28 cs.CL 57%

QwenLong-CPRS: Towards $\infty$-LLMs with Dynamic Context Optimization

Weizhou Shen, Chenliang Li, Fanqi Wan, Shengyi Liao, Shaopeng Lai, Bo Zhang, Yingcheng Shi, Yuning Wu, Gang Fu, Zhansheng Li, Bin Yang, Ji Zhang, Fei Huang, Jingren Zhou, Ming Yan

机构 * Tongyi Lab, Alibaba Group(通义实验室,阿里集团)

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14838 2025-05-28 cs.CL 57%

DynamicKV: Task-Aware Adaptive KV Cache Compression for Long Context LLMs

Xiabin Zhou, Wenbin Wang, Minyan Zeng, Jiaxian Guo, Xuebo Liu, Li Shen, Min Zhang, Liang Ding

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏