An experimental study of KV cache reuse strategies in chunk-level caching systems
基于块级缓存系统的KV缓存重用策略实验研究
专题命中 长文档RAG :retrieval-augmented generation(abstract);分类 cs.CL
AI总结 本文通过实验探讨块级缓存系统中KV缓存重用策略的局限性与优化方法,提出一种融合现有技术的改进设计以提升准确性。
AI 大模型
检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。
基于块级缓存系统的KV缓存重用策略实验研究
专题命中 长文档RAG :retrieval-augmented generation(abstract);分类 cs.CL
AI总结 本文通过实验探讨块级缓存系统中KV缓存重用策略的局限性与优化方法,提出一种融合现有技术的改进设计以提升准确性。
AVIATOR:面向高保真、大规模代码安全数据集的AI代理漏洞注入流程
机构 * National Institute of Standards and Technology, Software and Systems Division(美国国家标准与技术研究院软件与系统 division) ; Université Grenoble Alpes, CNRS, LIG(格勒诺布尔阿尔卑斯大学,法国国家科学研究中心,LIG实验室)
专题命中 长文档RAG :RAG(abstract);分类 cs.AI
AI总结 本文提出AVIATOR,首个AI代理漏洞注入框架,通过协调AI代理、工具分析和迭代自我纠正,生成高保真漏洞数据,提升漏洞检测模型性能。
编译记忆:不是更多信息,而是为语言代理提供更精确的指令
机构 * AlphaBitCore, Inc.(AlphaBitCore公司)
专题命中 长文档RAG :RAG(abstract);分类 cs.AI
AI总结 本文提出Atlas内存内核,通过编译积累的任务经验为语言代理生成指令结构,无需微调、RAG或人工干预,提升GPT-4o和Claude Sonnet~4.5在合同分析和多跳问答任务中的性能。
基于代理的DAG编排规划框架:用于混合数据湖中多模态、多跳问答系统
专题命中 长文档RAG :RAG(abstract);分类 cs.AI
AI总结 本文提出A.DOT规划框架,通过编译自然语言查询为DAG执行计划,实现多模态多跳问答,提升准确性和效率,并生成可追溯的证据链。
长文奖励基准:评估长文生成的奖励模型
专题命中 长文档RAG :RAG(abstract);分类 cs.CL
AI总结 本文提出Long-form RewardBench,首个专为长文生成设计的奖励模型评估平台,通过五个子任务评估20+主流模型,揭示分类与生成模型在长文奖励建模上的差异。
Comments Accepted by AAAI2026
LooComp: 通过留一法策略提升仅编码器Transformer的查询感知上下文压缩效率
机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)
专题命中 长文档RAG :retrieval augmented generation(abstract);分类 cs.CL
AI总结 LooComp通过留一法策略提升仅编码器Transformer的查询感知上下文压缩效率,实现高效压缩与高吞吐量推理。
超越片段化后再嵌入:信息检索中文档片段化策略的全面分类与评估
专题命中 长文档RAG :dense retrieval(abstract);分类 cs.IR
AI总结 本文研究了文档片段化策略在信息检索中的分类与评估,发现任务依赖性和分段方法差异影响效果,提出统一框架并提供公开基准。
Comments Github link will be pushed later as it's anonymoused at the moment
辩证管道用于提升大语言模型鲁棒性
机构 * Università degli Studi di Trieste(特里埃斯特大学)
专题命中 长文档RAG :RAG(abstract);分类 cs.CL
AI总结 本文提出一种辩证管道,通过自我对话提升大语言模型的鲁棒性,有效减少幻觉并提高输出质量。
LLMs Got Rhythm? 希腊诗歌押韵检测与生成的混合语音过滤
专题命中 长文档RAG :RAG(abstract);分类 cs.CL
AI总结 本文提出混合语音学算法与LLMs结合,解决希腊诗歌押韵检测与生成问题,通过验证循环提升性能至73.1%。
在语言模型重述中后置水印技术有多好?
机构 * FAIR, Meta Superintelligence Labs(FAIR、Meta超智能实验室)
专题命中 长文档RAG :RAG(abstract);分类 cs.CL
AI总结 本文研究了语言模型重述中后置水印技术的效果,发现简单方法在某些情况下表现优异,但对可验证文本效果不佳。
Comments Code at https://github.com/facebookresearch/textseal
C-GRASP:基于临床的感知信号处理推理
机构 * Department of Physics National Central University(物理系国立中央大学) ; Center for Education National Central University(教育中心国立中央大学)
专题命中 长文档RAG :RAG(abstract);分类 cs.AI
AI总结 C-GRASP通过临床基础推理提升情感信号处理的准确性与临床一致性。
从搜索结果页面到代理:一个用于信息交互比较研究的平台
专题命中 长文档RAG :RAG(abstract);分类 cs.IR
AI总结 UXLab是一个开源平台,用于比较信息交互系统,通过无代码实验设计支持多模态交互研究。
Journal ref Proceedings of the 2026 ACM SIGIR Conference on Human Information Interaction and Retrieval (CHIIR '26)
探究工具增强大语言模型中的工具-记忆冲突
机构 * University of Massachusetts Lowell(马萨诸塞大学洛约拉分校) ; University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
专题命中 长文档RAG :RAG(abstract);分类 cs.AI
AI总结 本文提出工具-记忆冲突的概念,发现现有LLMs在STEM任务中存在该问题,并评估了现有解决方法的不足。
Comments R2-FM Workshop @ ICML 2025
Kascade:一种适用于长上下文LLM推理的实用稀疏注意力方法
专题命中 长文档RAG :RAG(abstract);分类 cs.AI
AI总结 Kascade是一种无需训练的稀疏注意力方法,通过锚定层计算Top-k索引并重用,实现长上下文LLM推理中的高效注意力处理。
Comments 11 pages, 8 figures, 3 tables and 1 algorithm
PennyCoder: 用于PennyLane量子代码生成的高效领域特定LLM
专题命中 长文档RAG :RAG(abstract);分类 cs.AI
AI总结 PennyCoder是一种针对PennyLane量子编程的高效领域特定LLM,通过本地部署和低秩适应技术提升量子代码生成的准确性和效率。
Comments 6 pages, 5 figures, 3 tables, paper accepted to QCE 2025
Journal ref 2025 IEEE International Conference on Quantum Computing and Engineering (QCE), Albuquerque, NM, USA
专题命中 长文档RAG :RAG(abstract);分类 cs.AI
Comments 12 pages, 17 figures
机构 * Georgia Institute of Technology(佐治亚理工学院)
专题命中 长文档RAG :retrieval augmented generation(abstract);分类 cs.CL
Comments 12 pages, 5 figures
机构 * AI Lab, TrendMicro(趋势科技人工智能实验室)
专题命中 长文档RAG :RAG(abstract);分类 cs.AI
专题命中 长文档RAG :RAG(abstract);分类 cs.CL
机构 * Stanford University(斯坦福大学) ; UIUC(伊利诺伊大学香槟分校)
专题命中 长文档RAG :RAG(abstract);分类 cs.AI
Comments 27 pages, 5 figures, 21 tables
机构 * College of Computer Science, Zhejiang University(浙江大学计算机学院) ; NLP Lab, Westlake University(西湖大学自然语言处理实验室)
专题命中 长文档RAG :RAG(abstract);分类 cs.CL
机构 * Department of Industrial Engineering & Management Sciences, Northwestern University(工业工程与管理科学系,西北大学) ; Autodesk Research(Autodesk研究)
专题命中 长文档RAG :retrieval-augmented generation(abstract);分类 cs.AI
Comments Preprint
机构 * City St George's, University of London(伦敦城市圣乔治大学) ; The Alan Turing Institute, British Library(艾伦·图灵研究所,大英图书馆)
专题命中 长文档RAG :RAG(abstract);分类 cs.CL
Comments 8 pages, 1 figure, accepted to the ISWC 2025 LM-KBC Workshop
机构 * Artificial, Inc.(Artificial公司)
专题命中 长文档RAG :RAG(abstract);分类 cs.AI
机构 * KunLun Meta(昆仑元)
专题命中 长文档RAG :RAG(abstract);分类 cs.AI
机构 * Pennsylvania State University(宾夕法尼亚州立大学)
专题命中 长文档RAG :RAG(abstract);分类 cs.AI
Comments To appear in USENIX Security Symposium 2025. The code and data are at: https://github.com/Wang-Yanting/TracLLM
专题命中 长文档RAG :RAG(abstract);分类 cs.CL
Comments Accepted at 19th Conference on Neurosymbolic Learning and Reasoning (NeSy 2025)
机构 * Department of Aerospace Engineering, University of Michigan(密歇根大学航空航天工程系) ; Institute for Robotics and Intelligent Machines, Georgia Institute of Technology(佐治亚理工学院机器人与智能机器研究所) ; Department of Robotics, University of Michigan(密歇根大学机器人学系)
专题命中 长文档RAG :RAG(abstract);分类 cs.AI
Comments Accepted to IEEE Transactions on Robotics
机构 * Tongyi Lab, Alibaba Group(通义实验室,阿里集团)
专题命中 长文档RAG :RAG(abstract);分类 cs.CL
专题命中 长文档RAG :RAG(abstract);分类 cs.CL