arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 42 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 长文档RAG 42 篇

2608.00003 2026-08-04 cs.AI 新提交 70%

AutoFOAM: The Self-Refining Autonomous OpenFOAM Agent

AutoFOAM:自优化自主OpenFOAM智能体

Arun Govind Neelan, A Seshaditya

机构 * SimuNetics Onnes Cryogenics Quasi AI

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 AutoFOAM是基于Qwen-coder 2.5-14B微调的自主LLM智能体,通过7阶段迭代循环及三种抗退化机制,可基于自然语言指令完成OpenFOAM模拟,助力CFD工作流程普及与快速原型开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22157 2026-07-27 cs.AI 新提交 70%

Learning on the Job: Continual Learning from Deployment Feedback for Frozen-Weights Agents

在职学习:从部署反馈中对冻结权重智能体进行持续学习

Valentin Tablan, Scott Taylor, Kristoffer Bernhem

机构 * The Memory Company(记忆公司)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 研究人工智能冻结权重智能体如何从部署反馈中持续学习,核心方法是将冻结模型与外部记忆配对,主要贡献是通过该方法在银行领域任务中提升成功率,解决多个基线未解决任务,且结果可跨模型,记忆可迁移,相关内容已发布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21604 2026-07-27 cs.AI 新提交 70%

AgentKVShift: Efficient KV Cache Reuse for Agentic Memory Systems

AgentKVShift:用于智能体记忆系统的高效KV缓存重用

Nilesh Prasad Pandey, Jason Kong, Lanxiang Hu, Quanling Zhao, Yujie Zhao, Onat Gungor, Hao Zhang, Tajana Rosing

机构 * University of California, San Diego(加利福尼亚大学圣地亚哥分校)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 研究针对内存增强语言模型智能体推理成本高的问题,提出无训练、探针引导的AgentKVShift方法,通过估计内存级偏移量校正重用令牌,在多语言模型和基准测试中表现出色,实现低重新计算量和预填充加速,还能与缓存量化正交组合提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07740 2026-07-13 cs.LG cs.AI 新提交 70%

Jet-Long: Efficient Long-Context Extension with Dynamic Bifocal RoPE

Jet-Long:使用动态双焦点旋转位置编码的高效长上下文扩展

Haozhan Tang, Zerui Wang, Yuxian Gu, Song Han, Han Cai

机构 * NVIDIA(英伟达)

专题命中 长文档RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 研究针对现代语言模型长上下文应用中零样本上下文扩展问题,提出Jet-Long方法,通过动态双焦点RoPE及相关技术,在推理时开销小,在多种模型和基准测试中表现优异,还能推广到其他架构且超参数弹性强。

Comments added discussion of AdaGroPE and LaMPE (Findings of ACL 2026) with clarified contribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23108 2026-06-23 cs.AI 新提交 70%

TTFT-Aware Graph Chain-of-Thought:Distance-Indexed Neural A* for Low-Hallucination Multi-Hop Medical Reasoning

TTFT感知的图链式思维:用于低幻觉多跳医学推理的距离索引神经A*

Bechir Dardouri, Kaïs Zhioua, Yassine Msaddak

机构 * Tanit Healthcare Technologies, Tunisia(突尼斯塔尼特医疗技术公司)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 提出一种生产级GraphRAG框架,通过距离索引的神经A*算法在医学知识图谱中导航,结合PLL精确距离和AStarNet启发式,实现低延迟、低幻觉的多跳推理,并改善首令牌时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17637 2026-06-17 cs.AI 新提交 70%

Brick-DICL: Dynamic In-Context Learning for Automated Brick Schema Classification

Brick-DICL:用于自动化Brick模式分类的动态上下文学习

Yiyue Qian, Shinan Zhang, Huan Song, Negin Sokhandan, Hannah Marlowe, Diego Socolinsky

机构 * Amazon AWS Generative AI Innovation Center(亚马逊AWS生成式AI创新中心)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 提出Brick-DICL两阶段动态上下文学习框架,通过元数据检索和类别检索增强大语言模型领域知识,结合多模型过滤机制,实现楼宇管理系统点位的自动化Brick分类,显著提升准确率并减少人工验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08539 2026-06-09 cs.AI 新提交 70%

AgentTrust: A Self-Improving Trust Layer for AI-Agent Actions

AgentTrust: AI代理行为的自改进信任层

Chenglin Yang

机构 * Independent Researcher(独立研究员)

专题命中 长文档RAG :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 提出AgentTrust v2,通过威胁类型分类(词汇/语义)和自学习机制,在代理行为中实现自改进信任决策,显著提升语义威胁检测准确率并降低误拦。

Comments 29 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12970 2026-08-14 cs.SE 新提交 67%

Requirements-Augmented Generation for Trustworthy Acceptance Testing of LLM-Based Software

面向基于大语言模型的软件的可信验收测试的需求增强生成技术

Fanyu Wang, Chetan Arora, Zhenping Xie, Yonghui Liu, Kla Tantithamthavorn, Aldeida Aleti, Siwei Jiang

专题命中 长文档RAG :RAG(abstract,abstract_cn)

AI总结 该研究针对基于大语言模型的软件的验收测试缺口,提出需求增强生成技术与置信度校准级联判定方法,经工业案例验证可提升预言机质量、准确率与成本效率,具备工业可行性。

Comments Accepted at ASE2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09186 2026-08-11 cs.CV 新提交 67%

RAGMesh with FaME-G2E: Long-Form Text-Driven 3D Face Generation and Editing

结合FaME-G2E的RAGMesh:长文本驱动的3D人脸生成与编辑

Hao Li, Ju Dai, Feng Zhou, Mengting Shi, Haofei Wang, Zhen Song, Wei Zhou, Lei Li, Junjun Pan

机构 * Beihang University(北京航空航天大学) Pengcheng Laboratory(鹏城实验室) Shanxi University of Finance and Economics(山西财经大学) North China University of Technology(北方工业大学) Cardiff University(卡迪夫大学) Beijing Institute of Technology(北京理工大学)

专题命中 长文档RAG :RAG(abstract,abstract_cn)

AI总结 该研究构建了含文本-网格等标注的FaME-G2E数据集,提出RAGMesh框架,含MSRF模块与AdaRAGS约束,在3D人脸生成编辑任务上性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05577 2026-07-08 cs.AI cs.CL cs.IR 新提交 67%

Narrative World Model: Narratology-Grounded Writer Memory for Long-Form Fiction

叙事世界模型:基于叙事学的长篇小说作者记忆

Mohammad Saifullah, Thomas Kornmaier, Taaha Kazi, Vasu Sharma, Aditya Sanjiv Kanade, Aanand Kumar Yadav

机构 * PocketFM(口袋FM)

专题命中 长文档RAG :hybrid retrieval(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 研究针对长篇小说作者记忆问题,提出叙事世界模型(NWM),结合叙事学时间状态图与查询条件混合检索,在多跳叙事学问答上显著优于基线,优势源于其独特表征,非提取方式。

Comments 23 pages, 4 figures; 9-page main text plus appendix. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11354 2026-06-11 cs.ET 新提交 67%

A Zero-Shot Multi-Agent Framework for Human-Building Interaction via Programmatic Reasoning

通过程序化推理实现人楼交互的零样本多智能体框架

Yuqi Wang, Gulai Shen, Ali Mehmani

专题命中 长文档RAG :RAG(abstract,abstract_cn)

AI总结 提出一种分层多智能体框架,利用语义路由和程序化推理解耦自然语言理解与建筑分析,通过“门卫”机制分解任务并生成可执行Python脚本,在200多栋商业建筑数据上验证了准确性和上下文响应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18781 2026-06-18 cs.CL 新提交 57%

Lost in a Single Vector: Improving Long-Document Retrieval with Chunk Evidence Aggregation

迷失在单一向量中:通过分块证据聚合改进长文档检索

Shanshan Lyu, Yiwei Wang, Yujun Cai, Jiafeng Guo, Shenghua Liu

机构 * Chongqing University(重庆大学) State Key Laboratory of AI Safety(人工智能安全国家重点实验室) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of California, Merced(加州大学默塞德分校) University of Queensland(昆士兰大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 长文档RAG :dense retrieval(abstract);分类 cs.CL

AI总结 针对长文档检索中单向量编码削弱关键片段证据的问题,提出无训练的分块证据聚合策略DICE,通过独立编码分块并聚合为单一向量,在保持标准接口的同时显著提升检索性能。

Comments Code is available at https://github.com/PunchlineAAAA/DICE

详情

展开后加载摘要…

URL PDF HTML 收藏