arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 8561 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 4552 篇

2607.19020 2026-07-22 cs.LG cs.AI cs.IR q-bio.QM 新提交 62%

Biological Amnesia in ICU Time-Series Prediction: A Drift-Adaptive Two-Stream Architecture with Temporal Retrieval

重症监护室时间序列预测中的生物失忆:一种具有时间检索的漂移自适应双流架构

Fatema Ferdous Tamanna, K. M. Merajul Arefin, Md. Abdul Masud

机构 * Patuakhali Science and Technology University(帕图阿卡利科学技术大学) University of Dhaka(达卡大学)

专题命中 检索器与排序 :RAG(abstract);分类 cs.IR、cs.AI

AI总结 研究重症监护室时间序列预测中临床决策支持系统退化问题,提出自适应临床智能架构,通过解耦生理与治疗表征、限制参数更新等实现漂移自适应,实验验证其有效性,为高风险临床环境中部署自适应模型提供模板。

Comments 10 pages, 3 figures, 8 tables. Code and aggregate audit logs available at: [https://github.com/empresst/ClinicalRag]. Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18756 2026-07-22 cs.IR cs.CL 新提交 62%

RAGAL: A Frugal, Fully Local Retrieval-Augmented Assistant for Technical Support at a Government Agency

RAGAL:政府机构技术支持的节俭型全本地检索增强助手

Dan Musetoiu

机构 * IT Department, Agency for Financing Rural Investments (AFIR)(金融农村投资机构信息部)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.CL

AI总结 针对公共机构数据不能流出的限制,开发RAGAL检索增强助手。在特定语料库上验证,检索工程和微调效果好,记录单域微调问题及解决方法,还有两个发现和全嵌入器微调方法,最后介绍零流出下的替代评判方案并开源脚本。

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05493 2026-07-22 cs.CL cs.AI cs.MA 版本更新 62%

LinguistAgent Technical Report: A Reflective Multi-Model Platform for Automated Linguistic Annotation

LinguistAgent: 一个用于自动化语言标注的反思多模型平台

Bingru Li

机构 * University of Birmingham(伯明翰大学)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 LinguistAgent通过反思多模型架构实现自动化语言标注,采用双代理工作流程模拟同行评审,支持多种标注范式并提供实时评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17598 2026-07-21 cs.AI cs.CL cs.SE 新提交 62%

Is Progressive Disclosure All You Need for Long-Context Agents?

长上下文智能体仅靠渐进式披露就够了吗?

Yifeng He, Yinzhe Zhao, Jicheng Wang, Hao Chen

机构 * University of California, Davis(加利福尼亚大学戴维斯分校) Zhejiang University(浙江大学) The University of Hong Kong(香港大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL、cs.AI

AI总结 研究长文档问答中智能体获取文档路径自行决定读取内容的模式,通过对照研究,在InfiniteBench上对比原始文档导航、Agent Skills包设计与经典混合检索器,发现不同情况下各方法表现不同,渐进式披露在语料库大时作用关键。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14115 2026-07-17 cs.AI cs.CL cs.CV 新提交 62%

DialogueVPR: Towards Conversational Visual Place Recognition

DialogueVPR:迈向对话式视觉场所识别

Yukun Song, Changwei Wang, Xingtian Pei, Shibiao Xu, Wenhao Xu, Shunpeng Chen, Yu Zhang, Ke Zhang, Rongtao Xu, Xuxiang Feng, Pengyang Wang

机构 * School of Artificial Intelligence, Beijing University of Posts and Telecommunications(北京邮电大学人工智能学院) Shandong Computer Science Center, Qilu University of Technology(山东省计算中心(国家超级计算济南中心),齐鲁工业大学) Macquarie University(麦考瑞大学) Spatialtemporal AI(时空人工智能公司) University of Macau(澳门大学) Aerospace Information Research Institute(航天信息研究所)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL、cs.AI

AI总结 研究针对语言引导地理定位中现有方法不足,提出DlgPR,将场所识别转为对话驱动推理过程。构建DlgQuest-Cities基准及统一推理框架,用课程训练DQ-pilot,通过特定指标指导学习并实验,该方法显著优于基线。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07372 2026-07-14 cs.CL cs.AI 版本更新 62%

Conditional Memory via Scalable Lookup: A New Axis of Sparsity for Large Language Models

通过可扩展查找实现条件记忆:大语言模型稀疏性的新轴

Xin Cheng, Rui Tian, Wangding Zeng, Damai Dai, Qinyu Chen, Bingxuan Wang, Zhenda Xie, Kezhao Huang, Xingkai Yu, Chengqi Deng, Shangyan Zhou, Chenggang Zhao, Zhewen Hao, Yukun Li, Han Zhang, Zhengyan Zhang, Yixu Wei, M. Y Xu, Huishuai Zhang, Dongyan Zhao, Wenfeng Liang

机构 * Peking University(北京大学) DeepSeek-AI

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.CL、cs.AI

AI总结 研究针对Transformer缺乏知识查找原语的问题,引入条件记忆及Engram模块,通过制定稀疏分配问题发现U形缩放定律,扩展Engram至27B参数,在多领域提升性能,揭示其优势,为下一代稀疏模型提供重要建模原语。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00651 2026-07-13 cs.AI cs.CL cs.IT cs.MA cs.NI math.IT 版本更新 62%

Leveraging Multi-Agent System (MAS) and Fine-Tuned Small Language Models (SLMs) for Automated Telecom Network Troubleshooting

利用多智能体系统(MAS)和微调后的小语言模型(SLM)实现电信网络自动化故障排除

Chenhua Shi, Bhavika Jalli, Gregor Macdonald, John Zou, Wanlu Lei, Mridul Jain, Joji Philip

机构 * Ericsson(爱立信)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL、cs.AI

AI总结 针对电信网络故障排除难题,提出基于多智能体系统(MAS)的方法,利用大语言模型协调专业工具,通过微调小语言模型生成修复计划,实现全自动故障排除,加速了无线接入网和核心网领域的故障排除自动化。

Comments 6 pages, 7 figures, 1 table, 2026 IEEE ICC Workshop on Wireless Foundation Models for AI-native 6G and Beyond

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05441 2026-07-08 cs.IR cs.AI 新提交 62%

PORTS: Preference-Optimized Retrievers for Tool Selection with Large Language Models

PORTS:用于大语言模型工具选择的偏好优化检索器

Lorenzo Molfetta, Giacomo Frisoni, Nicolò Monaldini, Gianluca Moro

机构 * Department of Computer Science and Engineering, University of Bologna(计算机科学与工程系,博洛尼亚大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.AI

AI总结 研究针对大语言模型工具选择中现有检索器与LLMs不一致问题,提出PORTS方法,利用受困惑度启发的偏好信号,通过优化相关性及施加对比语义损失微调检索器,经多实验验证其通用性及提高工具选择准确性的能力,且计算需求低便于推广。

Comments Please cite the definitive, peer-reviewed version of this article published in the Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing, edited by Christos Christodoulopoulos et al., Association for Computational Linguistics, pp. 10007-10030, 2025. DOI: https://doi.org/10.18653/v1/2025.emnlp-main.507

Journal ref Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing, Association for Computational Linguistics, pp. 10007-10030, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04088 2026-07-07 cs.IR cs.AI 新提交 62%

Submitted and Diagnostic Analysis of Full-Text Temporal Retrieval for LongEval-Sci

LongEval-Sci的全文时间检索的提交与诊断分析

Yingdong Yang, Haijian Wu

机构 * CLEF 2026

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.AI

AI总结 研究LongEval-Sci科学检索,比较多种方法与基线。全文检索是基础,时间整合可提升官方纵向有效性,引用证据待优化。还报告基于摄取速度和陈旧覆盖漂移的定性每周IR系统更新监测分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02950 2026-07-07 cs.CL cs.AI cs.HC 版本更新 62%

Structured Prompting and Automated Evaluation in Fixed Synthetic Japanese-Language Counseling Dialogues

固定合成日语咨询对话中的结构化提示与自动评估

Keita Kiuchi, Yoshikazu Fujimoto, Hideyuki Goto, Tomonori Hosokawa, Makoto Nishimura, Yosuke Sato, Izumi Sezai, Tomohiro Inoue

机构 * Japan National Institute of Occupational Safety and Health(日本国立职业安全卫生研究所) Kaze To Taiyo(凯泽・太阳) Saga Occupational Health Association(Saga职业健康协会) Department of Pharmacy, Zikei Hospital/Zikei Institute of Psychiatry(药剂科,Zikei医院/Zikei精神医学研究所) Department of Medical Welfare, Suzuka University of Medical Science(医疗福祉科, Suzuka医科大学) Graduate School of Human Sciences, Ritsumeikan University(人类科学研究生院,立命馆大学) Faculty of Nursing, National Defense Medical College(护理学部,国家防卫医疗大学) Support Center for Students with Disabilities, Aoyama Gakuin University(残疾学生支持中心,上智大学)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 研究通过人工智能生成的18份固定日语咨询对话记录,对比GPT - minimal、GPT - SMDP和Claude - SMDP三种情况,咨询专家与新的语言模型分别评级,发现SMDP对话在多方面获更高专家评级,语言模型评级可重复但偏宽松。

Comments 59 pages, 2 figures, 30 tables; supplemental material included; data and code at https://doi.org/10.5281/zenodo.21182321; preregistration at https://doi.org/10.17605/OSF.IO/VU286

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00004 2026-07-02 cs.IR cs.AI cs.LG 新提交 62%

Why Advanced Encoders Lag on Sparse Retrieval? The Answer and an Approach to Bridging Vocabulary Gaps

为什么高级编码器在稀疏检索上落后?答案及弥合词汇鸿沟的方法

Zhichao Geng, Yang Yang

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR、cs.AI

AI总结 发现高级编码器在稀疏检索中落后于旧模型的原因是词汇鸿沟:现代分词器使用原始、区分大小写的词汇表导致语义单元冗余。提出词汇迁移框架,通过语义初始化和激活势校准解决该问题,在BEIR上取得SOTA性能。

Comments Accepted at SIGIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29182 2026-06-30 cs.AI cs.CL cs.LG 62%

Evidence-Informed LLM Beliefs for Continual Scientific Discovery

基于证据的LLM信念用于持续科学发现

Dhruv Agarwal, Reece Adamson, Andrew McCallum, Peter Clark, Ashish Sabharwal, Bodhisattwa Prasad Majumder

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 针对AutoDiscovery将惊奇视为静态量而人类惊奇是非平稳的问题,提出证据信息化的LLM信念,通过基于嵌入的检索增强生成更新先验,并修改搜索过程以避免虚假奖励,平均非平稳惊奇提高30.62%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28387 2026-06-30 cs.IR cs.AI 62%

Schema-First Retrieval: Embedding Catalogs for Natural Language Analytics

Schema-First Retrieval: 面向自然语言分析的模式优先检索

Adarsh Agrawal, Shashank Indukuri

专题命中 检索器与排序 :vector search(abstract);分类 cs.IR、cs.AI

AI总结 提出Schema-First Retrieval方法,通过索引目录元数据而非数据行,结合向量搜索、重排序和工作负载记忆,显著提升文本到SQL的表和列召回率,减少SQL执行错误。

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24841 2026-06-24 cs.AI cs.CL 新提交 62%

Matching Tasks to Objectives: Fine-Tuning and Prompt-Tuning Strategies for Encoder-Decoder Pre-trained Language Models

匹配任务与目标:编码器-解码器预训练语言模型的微调和提示调优策略

Ahmad Pouramini, Hesham Faili

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.CL、cs.AI

AI总结 提出MTO框架,通过匹配任务与预训练目标,在少样本和全数据集场景下显著提升编码器-解码器模型的生成与问答性能,性能增益超120%。

Journal ref Appl Intell 54(20):9783-9810, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23937 2026-06-24 cs.CL cs.AI cs.LG 新提交 62%

When Retrieval Metrics Mislead: Measuring Policy Signal in Long-Horizon Tool-Use Agents

当检索指标误导:衡量长周期工具使用智能体中的策略信号

Tianyu Ding, Juan Pablo De la Cruz Weinstein

机构 * Amazon Web Services(亚马逊云服务)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL、cs.AI

AI总结 研究发现精确匹配的检索召回率会低估下游策略效用,通过分类器实验表明检索到的策略子句与黄金子句在宏F1上无显著差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18684 2026-06-24 cs.CR cs.AI cs.CL cs.LG cs.SY eess.SY 版本更新 62%

FALCON: Transforming Cyber Threat Intelligence into Deployable IDS Rules with Self-Reflection

FALCON:通过自我反思将网络威胁情报转化为可部署的入侵检测系统规则

Shaswata Mitra, Subash Neupane, Martin Duclos, Sudip Mittal, Aritran Piplai, Md Rayhanur Rahman, Edward Zieglar, Shahram Rahimi

机构 * Meharry Medical College(梅哈里医学院) The University of Texas at El Paso(德克萨斯理工大学) The University of Alabama(阿拉巴马大学) National Security Agency(国家安全局)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL、cs.AI

AI总结 提出FALCON框架,通过新颖的CTI-规则语义评分器实现规则检索、生成和验证,解决签名型入侵检测系统中规则创建的手动瓶颈和验证难题,在Snort和YARA平台上达到0.72平均相关性。

Comments 17 pages, 10 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22778 2026-06-23 cs.IR cs.CL 新提交 62%

HAKARI-Bench: A Lightweight Benchmark for Comparing Retrieval Architectures and Efficiency Settings under Unified Conditions

HAKARI-Bench:统一条件下比较检索架构和效率设置的轻量级基准

Yuichi Tateno

机构 * MIT License(MIT许可证)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.IR、cs.CL

AI总结 提出HAKARI-Bench轻量级基准,通过重构现有检索套件为统一格式的小型数据集,实现五种检索家族及其效率变体的同条件比较,在排名上高保真复现MTEB等大型基准。

Comments 48 pages. Code and leaderboard: https://huggingface.co/spaces/hakari-bench/leaderboard https://github.com/hakari-bench/hakari-bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18801 2026-06-18 cs.IR cs.AI 新提交 62%

SHIFT: Semantic Harmonization via Index-side Feature Transformation for Multilingual Information Retrieval

SHIFT: 通过索引侧特征变换实现多语言信息检索的语义对齐

Youngjoon Jang, Seongtae Hong, Hyeonseok Moon, Heuiseok Lim

机构 * Department of Computer Science and Engineering, Korea University(韩国大学计算机科学与工程系)

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR、cs.AI

AI总结 提出SHIFT方法,在索引阶段通过平行翻译对估计相对语言向量并修正文档嵌入,以缓解多语言密集检索中的语言偏差,无需训练即可提升检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18717 2026-06-18 cs.CL cs.AI 新提交 62%

Morpheus: A Morphology-Aware Neural Tokenizer and Word Embedder for Turkish

Morpheus: 一种面向土耳其语的形态感知神经分词器和词嵌入器

Tolga Şakar

机构 * Independent Researcher(独立研究者)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL、cs.AI

AI总结 针对土耳其语粘着特性,提出Morpheus神经词素边界模型,实现无损可逆分词与结构化词嵌入,在可逆分词器中达到最低比特每字符(1.425),词素对齐F1提升至0.61,GPU内存节省约19%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17664 2026-06-17 cs.IR cs.AI 新提交 62%

Temporal Preference Optimization for Unsupervised Retrieval

面向无监督检索的时间偏好优化

HyunJin Kim, Jaejun Shim, Young Jin Kim, JinYeong Bak

机构 * Microsoft, Redmond, USA(微软公司,美国红mond) Sungkyunkwan University, Suwon, South Korea(成均馆大学,韩国首尔)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.AI

AI总结 提出TPOUR方法,通过时间检索偏好优化(TRPO)和可学习时间嵌入插值,使无监督稠密检索器能捕捉时间相关性,在时间信息检索任务上超越有监督和无监督基线。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15396 2026-06-16 cs.CL cs.AI 新提交 62%

CHILLGuard: Towards Fine-Grained Chinese LLM Safety Guardrail with Scalable Data Construction and Model-aware Preference Alignment

CHILLGuard:面向细粒度中文大语言模型安全护栏的可扩展数据构建与模型感知偏好对齐

Wenbo Yu, Bohua Wang, Hao Fang, Kuofeng Gao, Jingru Zeng, Xiaochen Yang, Tianyi Zhang, Xiaoxiao Ma, Jiawei Kong, Hao Wu, Bin Chen, Shu-Tao Xia, Min Zhang

机构 * Tsinghua University(清华大学) Beijing Normal University(北京师范大学) South China University of Technology(华南理工大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Shenzhen ShenNong Information Technology Co., Ltd.(深圳神农信息技术有限公司)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

AI总结 针对中文场景,提出细粒度风险分类体系(5大类31小类),通过可扩展数据构建管道生成高质量训练数据,并采用模型感知直接偏好优化训练CHILLGuard,在基准上F1分数提升15.92%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14885 2026-06-16 cs.AI cs.CL 新提交 62%

Dr-DCI: Scaling Direct Corpus Interaction via Dynamic Workspace Expansion

Dr-DCI: 通过动态工作空间扩展实现直接语料交互的规模化

Yi Lu, Zhuofeng Li, Ping Nie, Haoxiang Zhang, Yuyu Zhang, Kai Zou, Wenhu Chen, Jimmy Lin, Dongfu Jiang, Yu Zhang

机构 * University of Toronto(多伦多大学) Texas A&M University(德克萨斯A&M大学) University of Waterloo(滑铁卢大学) UC San Diego(加州大学圣迭戈分校) Verdent AI Netmind AI

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL、cs.AI

AI总结 提出DR-DCI框架,将检索作为智能体可调用的动作来动态扩展本地工作空间,结合检索器的召回能力与DCI的局部操作精度,实现大规模语料上的高效搜索与验证。

Comments 25 pages, 4 figures, 22 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13905 2026-06-15 cs.IR cs.CL 新提交 62%

ADORE: Iterative Query Expansion with Retrieval-Grounded Relevance Feedback

ADORE: 基于检索反馈的迭代查询扩展

Amin Bigdeli, Negar Arabzadeh, Radin Hamidi Rad, Sajad Ebrahimi, Charles L. A. Clarke, Ebrahim Bagheri

机构 * University of Waterloo(滑铁卢大学) Mila – Quebec AI Institute(魁北克人工智能研究所) University of Toronto(多伦多大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.CL

AI总结 提出ADORE框架,通过迭代生成伪段落、检索语料库并评估相关性,利用检索反馈指导查询扩展,显著提升检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23336 2026-06-15 cs.IR cs.CL cs.LG 版本更新 62%

Efficient Rationale-based Retrieval: On-policy Distillation from Generative Rerankers based on JEPA

高效基于理由的检索:基于JEPA的生成重排序器的在线蒸馏

Teng Chen, Sheng Xu, Feixiang Guo, Xiaoyu Wang, Qingqing Gu, Hongyan Li, Luo Ji

机构 * Geely AI Lab(吉利人工智能实验室)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.CL

AI总结 本文提出Rabtriever,通过在线蒸馏从生成重排序器中学习,将查询和文档独立编码,提升检索效率,同时在多个任务中表现优异。

Comments 11 pages, 8 figures. ICMR 2026 (https://youtu.be/apDcrzEVwq4)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12451 2026-06-12 cs.AI cs.IR cs.LG 新提交 62%

ToolSense: A Diagnostic Framework for Auditing Parametric Tool Knowledge in LLMs

ToolSense: 审计LLM中参数化工具知识的诊断框架

Ashutosh Hathidara, Sai Shruthi Sistla, Sebastian Schreiber, Sahil Bansal

机构 * SAP Labs(SAP实验室)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.AI

AI总结 提出ToolSense诊断框架,自动生成三类基准测试,揭示参数化工具检索中知识-检索分离现象,发现模型在模糊查询下性能显著下降。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11780 2026-06-11 cs.IR cs.AI cs.IT math.IT 新提交 62%

What Limits Does Quantization Place on Dense Top-$k$ Retrieval? A Theoretical Study

量化对密集Top-$k$检索的限制是什么?一项理论研究

Koki Okajima, Tsukasa Yoshida

机构 * NTT, Inc.(日本电报电话株式会社)

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR、cs.AI

AI总结 理论证明在有限精度下,完美Top-$k$检索所需维度随语料库大小对数增长,量化精度存在阈值,影响实际系统设计。

Comments 9 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10842 2026-06-10 cs.CL cs.IR 新提交 62%

ConvMemory v2: A Recall-Preserving Top-10 Evidence Reranker for Conversational Memory Retrieval

ConvMemory v2: 一种保留召回率的前10证据重排序器用于对话记忆检索

Taiheng Pan

机构 * School of Computing and Information Systems, University of Melbourne(墨尔本大学计算与信息系统学院)

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR、cs.CL

AI总结 提出ConvMemory v2,一种轻量级重排序器,在保留v1的Recall@10前提下,通过微调交叉编码器提升MRR和H@1,并分析其机制。

Comments 19 pages, 3 figures. Single-author technical report. Extends arXiv:2605.28062 (ConvMemory v1). Code and checkpoint: github.com/pth2002/ConvMemory

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10388 2026-06-10 cs.IR cs.AI 新提交 62%

SkillResolve-Bench: Measuring and Resolving Same-Capability Ambiguity in Agent Skill Retrieval

SkillResolve-Bench:衡量和解决智能体技能检索中的同能力歧义

Jiandong Ding

机构 * Huawei Technologies Ltd(华为技术有限公司)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.AI

AI总结 针对智能体技能库中同一能力族内不同技能的执行风险,提出SkillResolve-Bench基准和SkillResolve方法,通过候选族解析和代表性选择,在保持高召回率的同时将有害技能暴露率降至0。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06647 2026-06-08 cs.IR cs.AI cs.LG 版本更新 62%

Superintelligent Retrieval Agent: The Next Frontier of Agentic Retrieval

超级智能检索代理:代理检索的下一个前沿

Zeyu Yang, Qi Ma, Jason Chen, Anshumali Shrivastava

机构 * Meta Superintelligence Labs(Meta超级智能实验室) Rice University(里士满大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.AI

AI总结 提出SIRA,通过单次语料判别性检索压缩多轮探索,利用LLM丰富文档词汇、预测查询缺失词汇并基于语料统计过滤,在BEIR基准上取得最强平均检索性能,并在下游QA任务中超越RL训练的代理系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05415 2026-06-05 cs.CL cs.AI cs.LG 62%

Executable Schema Contracts: From Automatic Ingestion to Multi-Source Retrieval

可执行模式合约:从自动摄入到多源检索

Padmaja Jonnalagedda, Yuguang Yao, Xiang Gao, Hilaf Hasson, Kamalika Das

机构 * Intuit AI Research(Intuit AI研究)

专题命中 检索器与排序 :vector search(abstract);分类 cs.CL、cs.AI

AI总结 提出一种自动从多源数据中发现可执行模式并将其作为共享合约的系统,通过模式约束的检索路由和结构化分析提升多源问答性能。

Comments 9 pages, 4 figures, plus supplementary appendix

详情

展开后加载摘要…

URL PDF HTML 收藏