arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 699 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 349 篇

2608.11592 2026-08-13 cs.RO 新提交 50%

Video2Track: From Real-World Interaction Videos to Steerable Adversarial Closed-Track Testing for Automated Driving Systems

Video2Track:从真实世界交互视频到自动驾驶系统的可操控对抗性封闭赛道测试

Mengjie Tian, Xinrui Zhang, Tianyu Li, Peizhi Zhang, Guirong Zhou, Haojie Feng, Junpeng Huang, Qixiang Zhang, Lu Xiong

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 本文提出Video2Track框架,通过两个耦合模块将真实驾驶视频交互场景转化为可操控对抗性封闭赛道测试,可复现实景交互场景并生成可控变体,为ADS验证提供可扩展方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06722 2026-08-10 cs.HC 新提交 50%

CustomDance: Customized 3D Dance Generation with Coarse-to-Fine Human-Centered Interactive Control

CustomDance:基于以人为中心的粗到细交互式控制的定制化3D舞蹈生成

Xulong Tang, Kaixing Yang, Xiaohu Guo, Prabhakaran Balakrishnan, Rawan Alghofaili

专题命中 检索器与排序 :retriever(abstract)

AI总结 CustomDance是基于粗到细交互式控制的定制化3D舞蹈生成系统,通过三阶段流程实现AI辅助编舞,在定量和定性比较中优于基线,为用户提供全面控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06060 2026-08-07 cs.CV 新提交 50%

Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval

从失败中学习:基于难负例的以检索为中心的思维链用于统一多模态检索

Zelong Sun, Jun Wang, Kaicheng Yang, Tiancheng Gu, Ziyong Feng, Zhiwu Lu

专题命中 检索器与排序 :retriever(abstract)

AI总结 该研究提出UniME-R1框架,通过基于难负例的以检索为中心的思维链(RC-CoT)学习从检索失败中优化,在多模态检索基准上提升了性能。

Comments 26 pages,10 figures,14 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04100 2026-08-06 hep-ph hep-ex hep-th 新提交 50%

Language-Guided Hypotheses Generation for Sparse SMEFT Analyses

用于稀疏SMEFT分析的语言引导假设生成

Ahmed Hammad, Veronica Sanz

专题命中 检索器与排序 :retrieval augmented generation(abstract)

AI总结 研究解决稀疏SMEFT分析中算符假设选择难题,提出开源llm4smeft框架,结合微调语言模型与检索增强生成,可本地运行且能生成候选算符及费希尔信息。

Comments 34 pages, 2 figures and 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01211 2026-08-04 cs.CV 新提交 50%

VaRS-Doc: Interpretation-Aware Variant Representations via Latent Self-Probing for Visual Document Retrieval

VaRS-Doc:面向视觉文档检索的、通过潜在自探测实现的、具备解释感知能力的变体表示方法

Haocheng Wang, Tongkun Guan, Wei Shen, Xiaokang Yang

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 本文针对视觉文档检索中固定文档表示难以适配不同查询意图的问题,提出VaRS-Doc框架,通过两阶段训练实现变体表示,在基准测试中达到最先进性能,解决了查询与文档编码的不匹配问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20116 2026-07-23 cs.CV 新提交 50%

RIM: A Retrieval-In-Matching Framework for Cross-Domain Global Visual Localization of UAVs

RIM:无人机跨域全局视觉定位的检索匹配框架

Xin Li, Siyuan Duan, Shang Wang, Zhimin Mao, Bingliang Hu, Geng Zhang

机构 * University of Chinese Academy of Sciences(中国科学院大学)

专题命中 检索器与排序 :retriever(abstract)

AI总结 研究无人机跨域全局视觉定位问题,提出检索匹配框架RIM,通过采样参考视图、两阶段微调SALAD及冻结检索器蒸馏解码器等方法,在多数据集零样本评估中表现出色,建立了高效可部署的定位管道。

Comments 56 pages, 10 figures, and 18 tables. Supplementary material is included

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19115 2026-07-22 cs.CV 新提交 50%

CR-Refiner: An Object-Centric Optimal Transport Reranker for Edit-Conditioned 3D Scene Retrieval

CR-Refiner:用于编辑条件3D场景检索的以对象为中心的最优传输重排器

Hao Wu, Jinjing Zhu, Nanyu Wu, Qianyi Cai, Heyi Lin, Hao Wang, Hui Xiong

机构 * Hong Kong University of Science and Technology(香港科技大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 检索器与排序 :retriever(abstract)

AI总结 研究编辑条件3D场景检索问题,提出CR-Refiner重排器,通过冻结语言模型解析编辑、不平衡最优传输问题评分候选对象、轴条件结构先验及语言模型验证器细化结果,在不同基础检索器上提升了硬子集检索指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15948 2026-07-20 cs.SE 新提交 50%

TARS: A Theory-of-Mind Agent for Personalized In-IDE Code Comprehension

TARS:用于个性化IDE内代码理解的心理理论智能体

Leopoldo Todisco, Antonio Della Porta, Stefano Lambiase, Fabio Palomba

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 研究针对代码理解中LLM助手的不足,提出TARS智能体,基于心理理论范式,剖析开发者特点并调整解释,通过检索增强生成联系项目文档。实验表明它能提升效率、降低认知负荷,解释更适配开发者。

Comments Accepted at ICSME 2026, Tool Demonstration and Data Showcase Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07529 2026-07-09 cs.GT 新提交 50%

FedMark-FM: Auditable, Risk-Adjusted Data Markets for Federated Foundation-Model Adaptation

FedMark-FM:用于联邦基础模型适配的可审计、风险调整数据市场

Phat T. Tran-Truong, Xuan-Bach Le, Minh Nhat Nguyen

专题命中 检索器与排序 :RAG(abstract)

AI总结 研究联邦基础模型适配中激励机制问题,提出FedMark-FM框架,将客户端视为工件卖家,用S3Val估计贡献,转换支付惩罚不良行为,经多任务评估表现出色,证明管道有序估值独特性,能在一定规模下保留专家。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01831 2026-07-03 cs.DC cs.LG 新提交 50%

Lynx: Progressive Speculative Quantization for accelerating KV Transfer in Long-Context Inference

Lynx: 渐进式推测量化加速长上下文推理中的KV传输

Wenchen Han, Gingfung Matthew Yeung, Marco Barletta, William Toner, Amory Hoste, Adam Barker

机构 * University College London(伦敦大学学院) Huawei(华为)

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 针对长上下文推理中KV缓存传输延迟问题,提出Lynx系统,通过将KV缓存分为高优先级Anchor流和低优先级Residual流,实现渐进式传输和推测解码,在降低首令牌延迟的同时保持高精度。

Comments 15 pages, 12 figures. This manuscript was originally submitted to SIGCOMM '26 in February 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00089 2026-07-02 cs.LG 新提交 50%

Representation as a Bottleneck for Mechanistic Interpretability: The Manifestation Unit Protocol

表征作为机械可解释性的瓶颈:Manifestation Unit 协议

Hussein Chouman, Wataru Sasaki, Tomokazu Matsui, Hirohiko Suwa, Keiichi Yasumoto

机构 * Ubiquitous Computing Systems Laboratory, Nara Institute of Science and Technology, Nara, Japan(奈良先端科学技术大学院大学普适计算系统实验室)

专题命中 检索器与排序 :hybrid retrieval(abstract)

AI总结 提出 Manifestation Unit 协议,将组件分析结果组织为结构化字段,通过混合检索实现可重用和可查询,在视觉和语言模型上验证了其优于非结构化基线,并揭示了核心字段。

Comments 65 pages. Interactive demos: https://manifestation-xai.github.io/manifestation-transformers/ , https://manifestation-xai.github.io/manifestation-cnn

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27280 2026-06-26 cs.CV 新提交 50%

Exact and Deterministic Patch Descriptor Retrieval via Hierarchical Normalization

通过层次归一化实现精确且确定性的局部特征描述子检索

Koichi Sato

专题命中 检索器与排序 :vector search(abstract)

AI总结 提出一种基于层次归一化的精确最近邻搜索方法,通过分支定界策略仅评估少量数据库条目,实现与穷举搜索相同的确定性结果,在UBC补丁数据集上获得12-14倍加速。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22924 2026-06-23 cs.CV 新提交 50%

MythraGen: Two-Stage Retrieval Augmented Art Generation Framework

MythraGen:两阶段检索增强艺术生成框架

Quang-Khai Le, Cong-Long Nguyen, Minh-Triet Tran, Trung-Nghia Le

机构 * University of Science, Ho Chi Minh city, Vietnam(胡志明市科学大学) Vietnam National University, Ho Chi Minh city, Vietnam(越南国家大学)

专题命中 检索器与排序 :retrieval augmented generation(abstract)

AI总结 提出MythraGen框架,结合艺术检索与LoRA微调,通过检索与提示最相似的艺术图像微调Stable Diffusion,在WikiArt数据集上生成高质量、风格匹配的艺术作品。

Comments SOICT 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21448 2026-06-23 cs.LG cs.IT eess.SP math.IT 新提交 50%

Fast-TurboQuant: A Multiplier-Free Online Vector Quantization Approach

Fast-TurboQuant:一种无乘法器的在线向量量化方法

Pedro M. R. Pereira, Felipe A. P. de Figueiredo, Rausley A. A. de Souza

机构 * National Institute of Telecommunications (Inatel)(国家电信研究所(Inatel))

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 提出Fast-TurboQuant,用结构化快速Johnson-Lindenstrauss变换替代密集随机旋转矩阵,实现无乘法器投影,在DBpedia数据集上获得19.7倍加速并提升召回率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19088 2026-06-18 cs.RO 新提交 50%

ReSiReg: Towards Spatially Consistent Semantics in Language-Conditioned Robotic Tasks

ReSiReg:面向语言条件机器人任务的空间一致语义

Simon Schwaiger, David Seyser, Alessandro Scherl, Wilfried Wöber, Gerald Steinbauer-Wagner

机构 * Graz University of Technology, Institute of Software Engineering and Artificial Intelligence(格拉茨技术大学,软件工程与人工智能研究所) University of Applied Sciences Technikum Wien, Department of Industrial Engineering(维也纳应用科技大学,工业工程系) University of Alicante, Department of Computer Technology(阿利坎特大学,计算机技术系) University of Natural Resources and Life Sciences, Institute for Integrative Nature Conservation Research(自然资源与生命科学大学,整合自然保护研究 institute)

专题命中 检索器与排序 :dense retrieval(abstract)

AI总结 提出ReSiReg方法,通过重构空间一致的VLM中间特征,改善密集语言接地检索,在OVSS和3D映射中提升空间一致性,并发布紧凑的25M参数VLM模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18031 2026-06-17 cs.SI 新提交 50%

Pareto Optimal Re-ranking with Semi-Automated Content Credibility Detection

基于半自动化内容可信度检测的帕累托最优重排序

Yigit Ege Bayiz, Arash Amini, Ufuk Topcu

专题命中 检索器与排序 :retrieval augmented generation(abstract)

AI总结 提出一种双目标优化方法,通过最小化斯皮尔曼脚距保持原始排序,同时最大化内容可信度,并设计半自动化管道结合检索增强与人工核查分配可信度分数,在X平台数据上实现帕累托最优前沿偏差不超过7%。

Comments Submitted to CDC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17789 2026-06-17 cs.HC 新提交 50%

Mind Companion: An Embodied Conversational Agent for Process-Based Psychotherapy

Mind Companion: 一种用于基于过程心理治疗的具身对话代理

Sofie Kamber, Lukas Diebold, Pascal Riachi, Stella Brogna, Andrew Gloster, Rafael Wampfler

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 提出Mind Companion,一种基于大语言模型的具身对话代理,通过多层级心理分析与过程治疗原则,实时分析客户陈述并生成回应,评估显示GPT-5.2在多个维度上优于人类治疗师。

Journal ref 2026 IEEE 14th International Conference on Healthcare Informatics (ICHI), Minneapolis, MN, June 1-3, 2026, pp. 980-989

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17619 2026-06-17 cs.CV 新提交 50%

RAVA: Retrieval-Augmented Viewpoint Alignment for Subject-Driven Image Generation

RAVA: 检索增强的视角对齐用于主题驱动图像生成

Qiwei Yan, Zhiqiang Yuan, Chongyang Li, Jiapei Zhang, Ying Deng, Jinchao Zhang, Jie Zhou

机构 * WeChat AI, Tencent Inc.(腾讯微信人工智能实验室)

专题命中 检索器与排序 :retriever(abstract)

AI总结 提出RAVA框架,通过检索增强提供几何证据,解决跨主体视角对齐中的视角漂移和结构不匹配问题,在保持身份的同时实现可靠视角控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17094 2026-06-17 cs.SE 新提交 50%

LogCopilot: Automating Log Aggregation Analysis through Large Language Models

LogCopilot: 通过大型语言模型自动化日志聚合分析

Senyu Xie, Chenxi Zhang, Tong Zhou, Jiacheng Liu, Xiaoyu Hong, Qingshan Li, Xin Peng

专题命中 检索器与排序 :knowledge retrieval(abstract)

AI总结 提出LogCopilot框架,利用大型语言模型,通过自然语言指令、知识检索和工具调用自动生成LogQL查询,实现日志聚合分析,平均准确率76.8%。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 向量检索 38 篇

2607.18225 2026-07-21 econ.EM cs.LG math.ST stat.ME stat.ML stat.TH 新提交 93%

Vector Search As Nearest Neighbor Matching: RAG-based Policy Learning in Causal Inference

向量搜索作为最近邻匹配:因果推断中基于检索增强生成(RAG)的策略学习

Masahiro Kato, Taka Kato

机构 * np-hard.co.jp(np-hard公司)

专题命中 向量检索 :RAG(title,title_cn);vector search(title,abstract);retrieval-augmented generation(abstract)

AI总结 研究提出基于检索增强生成(RAG)的策略学习一步法和两步法,两步法通过向量搜索等进行行动选择,还将两步法遗憾分解并界定,直接评估一步法为策略,把特定行动向量搜索与因果推断最近邻匹配相联系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16973 2026-07-21 cs.LG cs.AI cs.IR 新提交 91%

TurboVec: A Case Study in Cost-Efficient Private Retrieval for Enterprise RAG via Codebook-Oblivious Quantization

TurboVec:通过码本无关量化实现企业RAG成本高效私有检索的案例研究

Navnit Shukla, Kamal Pandey, Omsankar Tiwari

专题命中 向量检索 :RAG(title,title_cn);retrieval-augmented generation(abstract);分类 cs.IR、cs.AI

AI总结 研究RAG系统向量检索层挑战,介绍基于TurboQuant的TurboVec开源向量索引。通过实验对比,表明TurboQuant在内存和召回率上有优势,TurboVec部署效果好,码本无关设计提升隐私性,不过存在单一数据集评估等局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09441 2026-06-09 cs.AI cs.AR 新提交 91%

SIFT: Selective-Index For Fast Compute of RAG Prefill by Exploiting Attention Invariance

SIFT: 利用注意力不变性实现RAG预填充快速计算的索引选择

Rya Sanovar, Srikant Bharadwaj, Hritvik Taneja, Moinuddin Qureshi

机构 * Georgia Institute of Technology(佐治亚理工学院) Microsoft(微软)

专题命中 向量检索 :RAG(title,title_cn);retrieval-augmented generation(abstract);分类 cs.AI

AI总结 针对RAG查询中文档重复导致预填充计算冗余和TTFT增加的问题,提出SIFT方法,通过离线提取文档高注意力分数位置并利用注意力不变性,在预填充时仅计算标记位置,将TTFT提升1.71倍且精度损失在1%以内。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01255 2026-08-04 cs.DB 新提交 90%

RaG-Tree: Combining R-Tree and HNSW for Multi-Attribute Range Filtered Approximate Nearest Neighbor Search

RaG-Tree:结合R树与HNSW的多属性范围过滤近似最近邻搜索

Jiawei Liu, Xiang Zhang, Chao Zhang, Ju Fan, Xiaoyong Du

专题命中 向量检索 :RAG(title,title_cn);分类 cs.DB

AI总结 本文提出RaG-Tree,一种结合R树与感知划分HNSW图的统一MR-ANNS索引,通过分层R树剪枝、适配局部分布的HNSW图及自适应搜索算法,在三个真实数据集上实现更优查询性能与轻量级索引、快速增量更新。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17538 2026-07-21 cs.AR cs.CL cs.DB cs.ET cs.IR 新提交 88%

D-NOVA: In-Storage Retrieval Accelerator via Dual-Bound 3D NAND-Optimized Similarity Search with Vector Adaptation

D-NOVA:通过具有向量适配的双边界3D NAND优化相似性搜索实现存储内检索加速器

Chang Eun Song, Sumukh Pinge, Tianqi Zhang, Sung Eun Kim, Tajana S. Rosing, Mingu Kang

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 向量检索 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);vector search(abstract);分类 cs.IR、cs.CL、cs.DB

AI总结 研究针对RAG密集向量检索性能瓶颈,提出软硬件协同设计的存储内检索加速器D-NOVA。通过深度嵌入搜索功能、采用新距离度量及引入适配器,实现高效检索,相比CPU和现有加速器有显著性能和能效提升,展现全存储向量搜索加速RAG的潜力。

Comments Accepted at the 59th IEEE/ACM International Symposium on Microarchitecture (MICRO 2026), Athens, Greece. Chang Eun Song and Sumukh Pinge are co-first authors and contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01192 2026-08-04 cs.CR cs.DB cs.PF 新提交 87%

A Unified Benchmark for Privacy-preserving Vector Search

面向隐私保护的向量搜索统一基准

Anne-Marie Kermarrec, Rafael Pires, Mathis Randl, Martijn de Vos

专题命中 向量检索 :vector search(title,abstract);RAG(abstract,abstract_cn);retrieval-augmented generation(abstract);分类 cs.DB

AI总结 本文构建隐私保护向量搜索统一基准,在相同条件下对比SAP、EMVP等方案性能,明确各方案隐私与性能权衡关系,为从业者提供部署选择依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00768 2026-07-02 cs.DB cs.IR 新提交 86%

RACORN-1: Adaptive Recall-Preserving Speedup for Low-Selectivity Filtered Vector Search

RACORN-1: 面向低选择性过滤向量搜索的自适应保召回加速方法

Yoonseok Kim, Gyusik Choe

专题命中 向量检索 :vector search(title,abstract);RAG(abstract,abstract_cn);分类 cs.IR、cs.DB

AI总结 针对ACORN-1在低选择性下召回率崩溃的问题,提出RACORN-1,通过自适应搜索回退(ASF)利用过滤失败节点作为临时桥梁恢复连通性,并引入自适应精确回退(AEF)处理极低选择性场景,在保持高召回的同时实现9-26倍加速。

Comments 13 pages, 11 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08751 2026-08-11 cs.DB 新提交 85%

InSituANN: Revisiting IVF for PCIe-Efficient Billion-Scale Vector Search

InSituANN:为PCIe高效的十亿级向量搜索重新审视IVF

Yuemeng Xu, Zongxi Liu, Junyu Long, Yiming Huang, Jiarui Guo, Yangyujia Wang, Jiachen Xu, Dongyuan Yu, Zongwei Lv, Tong Yang

专题命中 向量检索 :vector search(title,abstract);RAG(abstract,abstract_cn);分类 cs.DB

AI总结 InSituANN是一种基于IVF的ANNS引擎,将基础向量存于主机内存、就地执行精细搜索,在单个商用GPU上实现十亿级向量搜索,大幅提升吞吐量并开源。

Comments 16 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01276 2026-07-03 cs.CR cs.IR cs.LG 新提交 84%

Embedding Inference Attack

嵌入推理攻击

Cedric Fitiavana Raelijohn, Sébastien Gambs, Jean-Francois Rajotte

机构 * Université du Québec à Montréal(魁北克大学蒙特利尔分校)

专题命中 向量检索 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract);分类 cs.IR

AI总结 研究黑盒信息检索系统中,攻击者仅通过观察检索文档集合即可推断嵌入模型类型的方法,并验证其在含重排序器和RAG系统中的有效性。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19803 2026-06-19 cs.DB cs.AI cs.LG 新提交 84%

Policy-aware Vector Search: A Vision for Fine Grained Access Control in Vector Databases

策略感知向量搜索:向量数据库中细粒度访问控制的愿景

Lakshmi Sahithi Yalamarthi, Primal Pappachan

机构 * Portland State University(波特兰州立大学)

专题命中 向量检索 :vector search(title,abstract);retrieval augmented generation(abstract);分类 cs.AI、cs.DB

AI总结 本文提出策略感知向量搜索的愿景,形式化向量数据库中的细粒度访问控制(FGAC)策略模型与实施问题,比较不同实施策略并指出未来挑战。

Comments Accepted at SeQureDB 26, Sigmod 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04137 2026-08-06 cs.SE 新提交 83%

An Approach for Embedding-Guided Function Reuse Detection in Embedded C Software

嵌入式C软件中嵌入引导的函数复用检测方法

A A Talha Talukder, Omar Alam, Akramul Azim

专题命中 向量检索 :RAG(summary_cn,abstract);retrieval-augmented generation(abstract)

AI总结 本文提出领域感知RAG流水线,结合8种模型与4种硬件兼容性验证器,检测嵌入式C软件函数复用,解决SonarQube高假阳性问题,验证器准确率达97.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏