arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 385 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 长文档RAG 385 篇

2505.21940 2025-05-29 cs.CL 70%

RISE: Reasoning Enhancement via Iterative Self-Exploration in Multi-hop Question Answering

Bolei He, Xinran He, Mengke Chen, Xianwei Xue, Ying Zhu, Zhenhua Ling

机构 * University of Science and Technology of China(中国科学技术大学) Baidu Inc.(百度公司)

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21741 2025-05-29 cs.MA cs.CY cs.IR 70%

AI-Supported Platform for System Monitoring and Decision-Making in Nuclear Waste Management with Large Language Models

Dongjune Chang, Sola Kim, Young Soo Park

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR

Journal ref Proceedings of the WM2025 Conference, March 9-13, 2025, Phoenix, Arizona, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12788 2025-05-22 cs.CL 70%

Meta-Chunking: Learning Text Segmentation and Semantic Completion via Logical Perception

Jihao Zhao, Zhiyuan Ji, Yuchen Feng, Pengnian Qi, Simin Niu, Bo Tang, Feiyu Xiong, Zhiyu Li

机构 * School of Information, Renmin University of China(中国人民大学信息学院) Institute for Advanced Algorithms Research(高级算法研究所)

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15394 2025-05-22 cs.IR 70%

Reranking with Compressed Document Representation

Hervé Déjean, Stéphane Clinchant

专题命中 长文档RAG :RAG(abstract);retriever(abstract);分类 cs.IR

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05666 2025-05-12 cs.CV cs.AI 70%

Lost in OCR Translation? Vision-Based Approaches to Robust Document Retrieval

Alexander Most, Joseph Winjum, Ayan Biswas, Shawn Jones, Nishath Rajiv Ranasinghe, Dan O'Malley, Manish Bhattarai

机构 * Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室) Gianforte School of Computing(吉安福特计算学院) Montana State University Bozeman(蒙大拿州立大学博兹曼分校)

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23671 2025-04-03 cs.CL 70%

CrossFormer: Cross-Segment Semantic Fusion for Document Segmentation

Tongke Ni, Yang Fan, Junru Zhou, Xiangping Wu, Qingcai Chen

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20376 2025-03-27 cs.IR 70%

Dewey Long Context Embedding Model: A Technical Report

Dun Zhang, Panxiang Zou, Yudong Zhou

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR

Comments 5 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15277 2025-02-18 cs.CL 70%

BRIEF: Bridging Retrieval and Inference for Multi-hop Reasoning via Compression

Yuankai Li, Jia-Chen Gu, Di Wu, Kai-Wei Chang, Nanyun Peng

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Accepted by NAACL 2025 Findings. Project page: https://jasonforjoy.github.io/BRIEF/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00778 2025-01-03 cs.CL cs.CY 70%

Decoding the Flow: CauseMotion for Emotional Causality Analysis in Long-form Conversations

Yuxuan Zhang, Yulong Li, Zichen Yu, Feilong Tang, Zhixiang Lu, Chong Li, Kang Dang, Jionglong Su

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 7pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15511 2024-10-22 cs.IR 70%

ConTReGen: Context-driven Tree-structured Retrieval for Open-domain Long-form Text Generation

Kashob Kumar Roy, Pritom Saha Akash, Kevin Chen-Chuan Chang, Lucian Popa

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR

Comments Accepted at EMNLP'24 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06121 2024-10-10 cs.CL 70%

Less is More: Making Smaller Language Models Competent Subgraph Retrievers for Multi-hop KGQA

Wenyu Huang, Guancheng Zhou, Hongru Wang, Pavlos Vougiouklis, Mirella Lapata, Jeff Z. Pan

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Accepted by EMNLP 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10435 2024-08-21 cs.IR 70%

Enhanced document retrieval with topic embeddings

Kavsar Huseynova, Jafar Isbarov

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR

Comments Accepted to AICT 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02818 2024-06-06 cs.CL 70%

Chain of Agents: Large Language Models Collaborating on Long-Context Tasks

Yusen Zhang, Ruoxi Sun, Yanfei Chen, Tomas Pfister, Rui Zhang, Sercan Ö. Arik

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02472 2024-06-05 cs.CL 70%

Analyzing Temporal Complex Events with Large Language Models? A Benchmark towards Temporal, Long Context Understanding

Zhihan Zhang, Yixin Cao, Chenchen Ye, Yunshan Ma, Lizi Liao, Tat-Seng Chua

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Accepted to ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12970 2026-08-14 cs.SE 新提交 67%

Requirements-Augmented Generation for Trustworthy Acceptance Testing of LLM-Based Software

面向基于大语言模型的软件的可信验收测试的需求增强生成技术

Fanyu Wang, Chetan Arora, Zhenping Xie, Yonghui Liu, Kla Tantithamthavorn, Aldeida Aleti, Siwei Jiang

专题命中 长文档RAG :RAG(abstract,abstract_cn)

AI总结 该研究针对基于大语言模型的软件的验收测试缺口,提出需求增强生成技术与置信度校准级联判定方法,经工业案例验证可提升预言机质量、准确率与成本效率,具备工业可行性。

Comments Accepted at ASE2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09186 2026-08-11 cs.CV 新提交 67%

RAGMesh with FaME-G2E: Long-Form Text-Driven 3D Face Generation and Editing

结合FaME-G2E的RAGMesh:长文本驱动的3D人脸生成与编辑

Hao Li, Ju Dai, Feng Zhou, Mengting Shi, Haofei Wang, Zhen Song, Wei Zhou, Lei Li, Junjun Pan

机构 * Beihang University(北京航空航天大学) Pengcheng Laboratory(鹏城实验室) Shanxi University of Finance and Economics(山西财经大学) North China University of Technology(北方工业大学) Cardiff University(卡迪夫大学) Beijing Institute of Technology(北京理工大学)

专题命中 长文档RAG :RAG(abstract,abstract_cn)

AI总结 该研究构建了含文本-网格等标注的FaME-G2E数据集,提出RAGMesh框架,含MSRF模块与AdaRAGS约束,在3D人脸生成编辑任务上性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01348 2026-08-07 cs.CV 版本更新 67%

Prompt-Driven Simulation with Feature Perturbation for Cross-Domain Few-Shot Object Detection

面向跨域小样本目标检测的、结合特征扰动的提示驱动模拟方法

Linhai Zhuo, Junxi Cai, Tianwen Qian, Qingping Zheng, Yang Liu

机构 * Fuzhou University(福州大学) Xiamen University(厦门大学)

专题命中 长文档RAG :RAG(abstract,abstract_cn)

AI总结 本文提出PSP-FSOD框架,结合提示驱动域模拟与特征扰动正则化,缓解跨域小样本目标检测的域偏移与标注数据不足问题,在多个基准上实现性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01299 2026-07-14 cs.DC 版本更新 67%

HYPIC: Accelerating Hybrid-Attention LLM Serving with Position-Independent Caching

HYPIC: 利用位置无关缓存加速混合注意力LLM服务

Yifei Liu, Juntong Wu, Yang Liu, Junhao Hu, Minghao Li, Xiaoxu Chen, Weihang Chen

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract_cn)

AI总结 提出Hypic系统,通过段累积转移算子和边界重计算,实现混合注意力LLM的位置无关缓存,显著降低首令牌延迟并提升吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05577 2026-07-08 cs.AI cs.CL cs.IR 新提交 67%

Narrative World Model: Narratology-Grounded Writer Memory for Long-Form Fiction

叙事世界模型:基于叙事学的长篇小说作者记忆

Mohammad Saifullah, Thomas Kornmaier, Taaha Kazi, Vasu Sharma, Aditya Sanjiv Kanade, Aanand Kumar Yadav

机构 * PocketFM(口袋FM)

专题命中 长文档RAG :hybrid retrieval(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 研究针对长篇小说作者记忆问题,提出叙事世界模型(NWM),结合叙事学时间状态图与查询条件混合检索,在多跳叙事学问答上显著优于基线,优势源于其独特表征,非提取方式。

Comments 23 pages, 4 figures; 9-page main text plus appendix. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29142 2026-06-30 cs.CY cs.SE 67%

Agent Security Meets Regulatory Reality -- A Practitioner Systematization of Autonomous-Agent Threats and Controls in Regulated Financial Systems

代理安全遇上监管现实——受监管金融系统中自主代理威胁与控制的从业者系统化

Krishna Mohan, Guda Nagavenkata Srinivasa

专题命中 长文档RAG :RAG(abstract,abstract_cn)

AI总结 本文基于生产经验,将六类代理威胁映射到美欧金融监管义务,提出四种架构模式将手动流程自动化处理约80%案例,并报告三项负面结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20920 2026-06-29 cs.LG 版本更新 67%

Simplified Sparse Attention via Gist Tokens

遗忘,然后回忆:通过概要稀疏注意力实现可学习的压缩与选择性展开

Yuzhen Mao, Michael Y. Li, Emily B. Fox

机构 * Stanford University(斯坦福大学)

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract_cn)

AI总结 本文提出一种通过概要稀疏注意力实现可学习的压缩与选择性展开机制,结合紧凑的全局表示与目标访问细粒度证据,提升长上下文大语言模型的效率与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11354 2026-06-11 cs.ET 新提交 67%

A Zero-Shot Multi-Agent Framework for Human-Building Interaction via Programmatic Reasoning

通过程序化推理实现人楼交互的零样本多智能体框架

Yuqi Wang, Gulai Shen, Ali Mehmani

专题命中 长文档RAG :RAG(abstract,abstract_cn)

AI总结 提出一种分层多智能体框架,利用语义路由和程序化推理解耦自然语言理解与建筑分析,通过“门卫”机制分解任务并生成可执行Python脚本,在200多栋商业建筑数据上验证了准确性和上下文响应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19684 2026-04-29 cs.CR 67%

LLM-Assisted Authentication and Fraud Detection

基于大语言模型的认证与欺诈检测

Emunah S-S. Chan, Aldar C-F. Chan

专题命中 长文档RAG :RAG(abstract,abstract_cn)

AI总结 本文提出基于大语言模型的认证机制和欺诈检测流水线,通过语义判断和文档分段提升认证准确率,减少欺诈误报,验证了大语言模型在安全流程中的应用价值。

Comments 20 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23516 2026-04-14 cs.CL cs.AI cs.IR 67%

MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens

MSA:内存稀疏注意力用于高效端到端内存模型扩展至100M标记

Yu Chen, Runkai Chen, Sheng Yi, Xinda Zhao, Xiaohong Li, Jianjin Zhang, Jun Sun, Chuanrui Hu, Yunyun Han, Lidong Bing, Yafeng Deng, Tianqiao Chen

机构 * Evermind Shanda Group(盛大集团) Peking University(北京大学)

专题命中 长文档RAG :RAG(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 本文提出MSA,一种高效的端到端可训练内存模型框架,通过可扩展稀疏注意力和文档级RoPE实现线性复杂度,支持从16K到100M标记的扩展,同时保持稳定性,且在100M标记推理中实现2xA800 GPU的高效处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02985 2026-04-06 cs.IR cs.AI cs.CL 67%

Prompt Compression in the Wild: Measuring Latency, Rate Adherence, and Quality for Faster LLM Inference

野火中的提示压缩:测量延迟、速率遵守和质量以加快大语言模型推理

Cornelius Kummer, Lena Jurkschat, Michael Färber, Sahar Vahdati

机构 * ScaDS.AI Dresden/Leipzig, CIDS, TU Dresden(ScaDS.AI 德累斯顿/莱比锡,CIDS,德累斯顿工业大学)

专题命中 长文档RAG :RAG(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 本文研究了提示压缩在实际应用中的延迟、速率遵守和质量影响,通过大规模实验发现,当提示长度、压缩比和硬件容量匹配时,LLMLingua可实现18%的端到端加速,但超出此范围压缩步骤会抵消收益。

Comments Accepted at ECIR 2026 (Full Paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07334 2026-01-13 cs.LG 67%

Graph-KV: Breaking Sequence via Injecting Structural Biases into Large Language Models

Graph-KV: 通过向大语言模型注入结构偏差打破序列

Haoyu Wang, Peihao Wang, Mufei Li, Shikun Liu, Siqi Miao, Zhangyang Wang, Pan Li

机构 * Georgia Institute of Technology(佐治亚理工学院) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 Graph-KV通过引入结构偏差打破序列限制,提升大语言模型在图结构任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16822 2025-12-19 cs.LG 67%

MEPIC: Memory Efficient Position Independent Caching for LLM Serving

MEPIC:内存高效的无位置依赖缓存用于大语言模型服务

Qian Wang, Zahra Yousefijamarani, Morgan Lindsay Heisler, Rongzhi Gu, Bai Xiaolong, Shan Yizhou, Wei Zhang, Wang Lan, Ying Xiong, Yong Zhang, Zhenan Fan

机构 * Huawei Technologies Canada Co., Ltd.(华为技术加拿大有限公司) Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 MEPIC通过内存高效的无位置依赖缓存技术,实现跨请求和批次的片段KV重用,显著减少HBM使用量,提升大语言模型服务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24869 2025-10-14 cs.IR cs.AI cs.CL 67%

Retro*: Optimizing LLMs for Reasoning-Intensive Document Retrieval

Junwei Lan, Jianlyu Chen, Zheng Liu, Chaofan Li, Siqi Bao, Defu Lian

机构 * University of Science and Technology of China(中国科学技术大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Beijing University of Posts and Telecommunications(北京邮电大学) State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) Hong Kong Polytechnic University(香港理工大学) Hong Kong University of Science and Technology(香港科技大学)

专题命中 长文档RAG :RAG(abstract);分类 cs.IR、cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05502 2025-06-26 cs.CL cs.AI cs.IR 67%

Faux Polyglot: A Study on Information Disparity in Multilingual Large Language Models

Nikhil Sharma, Kenton Murray, Ziang Xiao

机构 * Johns Hopkins University(约翰霍普金斯大学) Center for Speech and Language Processing(语言与语音研究中心) Human Language Technology Center for Excellence(语言技术卓越中心)

专题命中 长文档RAG :RAG(abstract);分类 cs.IR、cs.CL、cs.AI

Comments NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05004 2024-10-08 cs.DC 67%

Fast State Restoration in LLM Serving with HCache

Shiwei Gao, Youmin Chen, Jiwu Shu

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract)

Comments EuroSys 2025

详情

展开后加载摘要…

URL PDF HTML 收藏