arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 8572 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 4558 篇

2510.21737 2026-03-19 cs.IR 57%

DPDisc: From Factoid Questions to Data Product Requests for Open-World Data Product Discovery over Tables and Text

DPDisc: 从事实性问题到数据产品请求的开放世界数据产品发现 over 表格和文本

Liangliang Zhang, Nandana Mihindukulasooriya, Niharika S. D'Souza, Sola Shirai, Sarthak Dash, Yao Ma, Horst Samulowitz

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.IR

AI总结 DPDisc 是首个针对混合表格-文本语料库的数据产品发现基准,通过自动化流程生成专业级请求并验证质量,包含13076个经过验证的实例,揭示了跨领域检索方法的性能差距。

Comments 15 pages, 4 figure, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17425 2026-03-19 cs.AI 57%

Proactive Knowledge Inquiry in Doctor-Patient Dialogue: Stateful Extraction, Belief Updating, and Path-Aware Action Planning

医生-患者对话中的主动知识探究:状态提取、信念更新与路径感知的动作规划

Zhenhai Pan, Yan Liu, Jia You

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.AI

AI总结 本文提出了一种基于部分可观测性的主动知识探究框架,通过状态提取、信念更新和路径感知动作规划,提升电子病历生成的覆盖性和准确性。

Comments 12 pages, 2 figures, 5 tables. Pilot concept demonstration under a controlled simulated setting

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11808 2026-03-18 cs.AI 57%

Automating Skill Acquisition through Large-Scale Mining of Open-Source Agentic Repositories: A Framework for Multi-Agent Procedural Knowledge Extraction

通过大规模开源代理仓库挖掘实现技能自动化获取:一种多代理过程知识提取框架

Shuzhen Bi, Mengsong Wu, Hao Hao, Keqian Li, Wentao Liu, Siyu Song, Hongbo Zhao, Aimin Zhou

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.AI

AI总结 本文提出一种多代理过程知识提取框架,通过挖掘开源仓库获取高质量代理技能,结合安全治理和评估指标实现可扩展的知识获取,提升知识转移效率40%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22819 2026-03-18 cs.AI cs.FL cs.LG 57%

Hilbert: Recursively Building Formal Proofs with Informal Reasoning

Hilbert:通过非正式推理递归构建形式证明

Sumanth Varambally, Thomas Voice, Yanchao Sun, Zhifeng Chen, Rose Yu, Ke Ye

机构 * UC San Diego(加州大学圣地亚哥分校) Apple(苹果公司)

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

AI总结 Hilbert结合非正式推理与形式验证,通过递归分解问题并利用反馈优化证明,显著提升在形式证明任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13644 2026-03-17 cs.AI 57%

StatePlane: A Cognitive State Plane for Long-Horizon AI Systems Under Bounded Context

StatePlane:一种适用于受限上下文的长期智能系统认知状态平面

Sasank Annapureddy, John Mulcahy, Anjaneya Prasad Thamatani

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 StatePlane通过认知状态管理实现长期智能,无需扩展上下文窗口或重新训练模型,适用于多会话任务。

Comments 5 pages, 1 figure, 3 tables, 1 algorithm

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13320 2026-03-17 cs.IR cs.LG 57%

Nepali Passport Question Answering: A Low-Resource Dataset for Public Service Applications

尼泊尔护照问答:一种低资源数据集用于公共服务应用

Funghang Limbu Begha, Praveen Acharya, Bal Krishna Bal

机构 * ILPRL Department of Computer Science \& Engineering Kathmandu University, Dhulikhel, Nepal School of Computing Dublin City University Dublin, Ireland

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.IR

AI总结 本文构建了一个尼泊尔语问答数据集,用于护照服务的FAQs,通过微调Transformer模型和BM25进行语义相似度检索,结果显示SBERT和多语言E5模型表现最佳。

Comments 7 pages, 3 figures, Accepted and presented at RegICON 2025 (Regional International Conference on Natural Language Processing): NLP for East India, North East India and Southeast Asia. accepted-papers" target="_blank" rel="noopener">https://www.regicon2025.in/accepted-papers

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20299 2026-03-13 cs.RO cs.AI cs.CV 57%

KnowVal: A Knowledge-Augmented and Value-Guided Autonomous Driving System

KnowVal: 一种知识增强且价值引导的自动驾驶系统

Zhongyu Xia, Wenhao Chen, Yongtao Wang, Ming-Hsuan Yang

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王学苑计算机技术研究所) University of California, Merced(加州大学默塞德分校)

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI

AI总结 KnowVal通过整合开放世界感知与知识检索,构建驾驶知识图谱并训练价值模型,实现价值对齐的自动驾驶系统,提升了规划性能并降低了碰撞率。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10578 2026-03-12 cs.CV cs.DB 57%

R4-CGQA: Retrieval-based Vision Language Models for Computer Graphics Image Quality Assessment

R4-CGQA: 基于检索的视觉语言模型用于计算机图形图像质量评估

Zhuangzi Li, Jian Jin, Shilv Cai, Weisi Lin

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.DB

AI总结 R4-CGQA通过构建包含3500张CG图像及其质量描述的数据集,提出双流检索框架提升视觉语言模型对计算机图形图像质量的评估能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10409 2026-03-12 cs.IR 57%

Differentiable Geometric Indexing for End-to-End Generative Retrieval

可微几何索引用于端到端生成检索

Xujing Wang, Yufeng Chen, Boxuan Zhang, Jie Zhao, Chao Wei, Cai Xu, Ziyu Guan, Wei Zhao, Weiru Zhang, Xiaoyi Zeng

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 本文提出可微几何索引,通过操作统一和各向同性几何优化,解决生成检索中的优化阻塞和几何冲突问题,提升长尾场景下的检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09332 2026-03-11 cs.SD cs.AI 57%

TimberAgent: Gram-Guided Retrieval for Executable Music Effect Control

TimberAgent:基于语法的可执行音乐效果控制检索

Shihao He, Yihan Xia, Fang Liu, Taotao Wang, Shengli Zhang

机构 * College of Electronics and Information Engineering, Shenzhen University(深圳大学电子与信息工程学院)

专题命中 检索器与排序 :RAG(abstract);分类 cs.AI

AI总结 TimberAgent通过纹理共振检索实现可编辑的音频效果控制,利用Gram矩阵构建音频表示,降低参数误差,提供更精确的效果控制方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09250 2026-03-11 cs.IR 57%

Evoking User Memory: Personalizing LLM via Recollection-Familiarity Adaptive Retrieval

唤起用户记忆:通过回忆-熟悉度适应检索个性化LLM

Yingyi Zhang, Junyi Li, Wenlin Zhang, Penyue Jia, Xianneng Li, Yichao Wang, Derong Xu, Yi Wen, Huifeng Guo, Yong Liu, Xiangyu Zhao

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 RF-Mem通过双路径记忆检索实现个性化LLM,结合回忆与熟悉度机制提升记忆检索效率和准确性。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04384 2026-03-10 cs.CL 57%

AgentIR: Reasoning-Aware Retrieval for Deep Research Agents

AgentIR: 为深度研究代理设计的推理感知检索

Zijian Chen, Xueguang Ma, Shengyao Zhuang, Jimmy Lin, Akari Asai, Victor Zhong

机构 * University of Waterloo(滑铁卢大学) University of Queensland(昆士兰大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL

AI总结 AgentIR通过结合推理轨迹与查询的联合嵌入和数据合成方法,提升深度研究代理的检索性能,实现68%的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07709 2026-03-10 cs.HC cs.AI 57%

YAQIN: Culturally Sensitive, Agentic AI for Mental Healthcare Support Among Muslim Women in the UK

YAQIN:面向英国穆斯林女性的文化敏感、代理型AI心理健康支持系统

Yasmin Zaraket, Céline Mougenot

机构 * Dyson School of Design Engineering, Imperial College London(帝京理工学院伦敦校区设计工程学院)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 YAQIN通过整合伊斯兰心理学和用户中心设计,为英国穆斯林女性提供文化敏感的AI心理健康支持,提升信任与治疗效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07271 2026-03-10 cs.IR 57%

AutoDataset: A Lightweight System for Continuous Dataset Discovery and Search

AutoDataset: 一个轻量级的连续数据集发现与搜索系统

Junzhe Yang, Xinghao Chen, Yunuo Liu, Zhijing Sun, Wenjin Guo, Xiaoyu Shen

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 AutoDataset通过自动化实时监控arXiv,实现数据集的快速发现与检索,显著提升数据集发现效率。

Comments 10 pages, 4 figures. Source code is available at https://github.com/EIT-NLP/AutoDataset. Screencast video: https://youtu.be/_QSxHKyIYns

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06588 2026-03-10 cs.LG cs.CL cs.PL 57%

vLLM Hook v0: A Plug-in for Programming Model Internals on vLLM

vLLM Hook v0: 一种用于编程vLLM内部模型的插件

Ching-Yun Ko, Pin-Yu Chen

机构 * IBM Research(IBM研究院)

专题命中 检索器与排序 :RAG(abstract);分类 cs.CL

AI总结 vLLM Hook v0 提供了一种插件,用于编程vLLM模型的内部状态,支持被动和主动编程,以增强模型的可编程性和功能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06397 2026-03-09 cs.IR cs.LG 57%

Efficient, Property-Aligned Fan-Out Retrieval via RL-Compiled Diffusion

通过强化学习编译扩散实现高效、属性对齐的扇出检索

Pengcheng Jiang, Judith Yue Li, Moonkyung Ryu, R. Lily Hu, Kun Su, Zhong Yi Wan, Liam Hebert, Hao Peng, Jiawei Han, Dima Kuzmin, Craig Boutilier

机构 * University of Illinois Urbana Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 R4T通过强化学习编译扩散模型,实现高效且属性对齐的扇出检索,提升检索质量并显著降低推理延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05781 2026-03-09 cs.CV cs.AI 57%

Visual Words Meet BM25: Sparse Auto-Encoder Visual Word Scoring for Image Retrieval

视觉词遇见BM25:稀疏自编码器视觉词评分用于图像检索

Donghoon Han, Eunhwan Park, Seunghyeon Seo

机构 * Moreh Seoul National University(首尔国立大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

AI总结 BM25-V通过稀疏自编码器提取的视觉词激活,结合BM25评分实现高效图像检索,提升召回率并降低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01509 2026-03-03 cs.CV cs.AI 57%

Retrieval, Refinement, and Ranking for Text-to-Video Generation via Prompt Optimization and Test-Time Scaling

通过提示优化和测试时扩展实现文本到视频生成的检索、细化与排序

Zillur Rahman, Alex Sheng, Cristian Meo

机构 * Algoverse AI

专题命中 检索器与排序 :RAG(abstract);分类 cs.AI

AI总结 本文提出3R框架,通过提示优化和测试时扩展提升文本到视频生成的准确性与效率。

Comments 2026 ICLR TTU Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01494 2026-03-03 cs.SE cs.AI cs.CR cs.LG 57%

Inference-Time Safety For Code LLMs Via Retrieval-Augmented Revision

通过检索增强的修订实现代码LLM的推理时安全性

Manisha Mukherjee, Vincent J. Hellendoorn

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 通过检索增强的修订机制提升代码LLM的推理时安全性,提高生成代码的安全性并减少漏洞。

Comments Accepted at the ICLR 2026 Workshop on Principled Design for Trustworthy AI: Interpretability, Robustness, and Safety Across Modalities

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01417 2026-03-03 cs.IR 57%

ReFeed: Retrieval Feedback-Guided Dataset Construction for Style-Aware Query Rewriting

ReFeed: 基于检索反馈的领域感知查询重写数据集构建

Jiyoon Myung, Jungki Son, Kyungro Lee, Jihyeon Park, Joohyung Han

专题命中 检索器与排序 :RAG(abstract);分类 cs.IR

AI总结 ReFeed通过检索反馈驱动数据集构建,提升查询重写模型对文档风格的感知能力,改进领域特定场景下的检索效果。

Comments Accepted at the Workshop on New Frontiers in Information Retrieval (AAAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00725 2026-03-03 cs.CL 57%

LaSTR: Language-Driven Time-Series Segment Retrieval

LaSTR:基于语言的时间序列片段检索

Kota Dohi, Harsh Purohit, Tomoya Nishida, Takashi Endo, Yusuke Ohtsubo, Koichiro Yawata, Koki Takeshita, Tatsuya Sasaki, Yohei Kawaguchi

机构 * Research(研究) Development Group, Hitachi, Ltd.(日立有限公司研发小组)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL

AI总结 LaSTR通过结合语言描述和时间序列数据,实现了高效的时间序列片段检索,提升了检索质量和语义一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00460 2026-03-03 cs.AI 57%

MED-COPILOT: A Medical Assistant Powered by GraphRAG and Similar Patient Case Retrieval

MED-COPILOT:一种基于图RAG和相似患者案例检索的医疗助手

Shuheng Chen, Namratha Patil, Haonan Pan, Angel Hsing-Chi Hwang, Yao Du, Ruishan Liu, Jieyu Zhao

机构 * University of Southern California(南加州大学)

专题命中 检索器与排序 :RAG(abstract);分类 cs.AI

AI总结 MED-COPILOT通过结合图RAG和相似患者案例检索,提升临床决策支持系统的证据整合与推理准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13530 2026-03-03 cs.AI 57%

REMem: Reasoning with Episodic Memory in Language Agent

REMem: 在语言代理中进行基于事件记忆的推理

Yiheng Shu, Saisri Padmaja Jonnalagedda, Xiang Gao, Bernal Jiménez Gutiérrez, Weijian Qi, Kamalika Das, Huan Sun, Yu Su

机构 * The Ohio State University(俄亥俄州立大学) Intuit AI Research(Intuit AI研究)

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

AI总结 REMem通过两阶段框架提升语言代理的事件记忆构建与推理能力,显著优于现有系统。

Comments Accepted by The Fourteenth International Conference on Learning Representations (ICLR 2026) as poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23766 2026-03-02 cs.IR 57%

UniFAR: A Unified Facet-Aware Retrieval Framework for Scientific Documents

UniFAR: 一种统一的面向面检索框架用于科学文档

Zheng Dou, Zhao Zhang, Deqing Wang, Yikun Ban, Fuzhen Zhuang

专题命中 检索器与排序 :RAG(abstract);分类 cs.IR

AI总结 UniFAR提出一种统一的面向面检索框架,通过自适应多粒度聚合、可学习的面向锚点和联合训练,有效解决文档与问题驱动检索之间的不匹配问题,提升科学文档检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25662 2026-03-02 cs.HC cs.AI 57%

User Misconceptions of LLM-Based Conversational Programming Assistants

基于大语言模型的对话式编程助手中的用户误解

Gabrielle O'Brien, Antonio Pedro Santos Alves, Sebastian Baltes, Grischa Liebel, Mircea Lungu, Marcos Kalinowski

机构 * University of Michigan(密歇根大学) Pontifical Catholic University of Rio de Janeiro(里约热内卢天主教大学) Heidelberg University(海德堡大学) Reykjavik University(雷克雅未克大学) IT University of Copenhagen(哥本哈根IT大学)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 研究揭示了用户在使用基于大语言模型的对话式编程助手时可能存在的误解,强调了工具在明确自身能力及通过实证研究澄清编程需求的重要性。

Comments Accepted to the Journal Ahead Workshop at ICSE '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01350 2026-02-26 cs.AI 57%

Error Notebook-Guided, Training-Free Part Retrieval in 3D CAD Assemblies via Vision-Language Models

通过视觉-语言模型实现无训练的3DCAD装配体部件检索:基于错误笔记本的引导

Yunqing Liu, Nan Zhang, Zhiming Tan

机构 * Fujitsu Research & Development Center Shanghai, China(富士通研发中心上海)

专题命中 检索器与排序 :RAG(abstract);分类 cs.AI

AI总结 本研究提出一种无训练的3D CAD部件检索方法,通过结合错误笔记本与RAG技术,显著提升基于VLM的推理性能,实验显示在专有模型和开源模型上均取得显著效果。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12434 2026-02-25 cs.AI 57%

A Survey on the Optimization of Large Language Model-based Agents

基于大语言模型代理的优化综述

Shangheng Du, Jiabao Zhao, Jinxin Shi, Zhentao Xie, Xin Jiang, Yanhong Bai, Liang He

机构 * Shanghai Institute of Artificial Intelligence for Education, East China Normal University(上海人工智能教育研究院,东华大学) School of Computer Science and Technology, East China Normal University(计算机科学与技术学院,东华大学) School of Computer Science and Technology, Donghua University(计算机科学与技术学院,东华大学)

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI

AI总结 本文综述了基于大语言模型的代理优化方法,分类讨论参数驱动与参数无关策略,分析关键技术和挑战,提出未来研究方向。

Comments Published in ACM Computing Surveys, Vol. 58, No. 9, Article 223, July 2026

Journal ref ACM Computing Surveys 58(9), Article 223, July 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04373 2026-02-24 cs.AI 57%

JEF-Hinter: Leveraging Offline Knowledge for Improving Web Agents Adaptation

利用离线知识提升网络代理适应性的JEF-Hinter

Hadi Nekoei, Aman Jaiswal, Patrice Bechard, Oleh Shliazhko, Orlando Marquez Ayala, Mathieu Reymond, Massimo Caccia, Alexandre Drouin, Sarath Chandar, Alexandre Lacoste

机构 * ServiceNow AI Research(ServiceNow AI研究机构) Chandar Research Lab(Chandar研究实验室) Mila -- Quebec AI Institute(魁北克人工智能研究院) Dalhousie University(达尔豪斯大学) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

AI总结 JEF-Hinter通过提炼离线轨迹生成上下文感知提示,提升网络代理在陌生领域的适应能力,实验显示其优于多种基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15050 2026-02-23 cs.CL 57%

Entailed Opinion Matters: Improving the Fact-Checking Performance of Language Models by Relying on their Entailment Ability

蕴含观点重要性:通过依赖生成语言模型的蕴含能力提升事实核查性能

Gaurav Kumar, Ayush Garg, Debajyoti Mazumder, Aditya Kishore, Babu kumar, Jasabanta Patro

机构 * Department of Data Science and Engineering(数据科学与工程系) Indian Institute of Science Education and Research(印度科学教育与研究学院)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文提出通过生成语言模型的蕴含能力提升事实核查性能,通过证据分类和蕴含论证训练仅编码器的语言模型,以提高事实核查的准确性。

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17654 2026-02-20 cs.IR cs.LG 57%

Mine and Refine: Optimizing Graded Relevance in E-commerce Search Retrieval

挖掘与精炼:优化电子商务搜索检索中的分级相关性

Jiaqi Xi, Raghav Saboo, Luming Chen, Martin Wang, Sudeep Das

机构 * DoorDash Inc.(DoorDash公司)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

AI总结 本文提出一种两阶段框架,通过挖掘和精炼提升电子商务搜索检索的分级相关性,结合对比学习和多类圆损失优化嵌入空间。

详情

展开后加载摘要…

URL PDF HTML 收藏