Tevatron-Elastic: A Unified Abstraction for Training Elastic Retrievers and Rerankers
Tevatron-Elastic:用于训练弹性检索器和重排序器的统一抽象
专题命中 检索器与排序 :retriever(abstract);分类 cs.CL
AI总结 Tevatron-Elastic提出统一抽象,可训练支持多种规模的检索器与重排序器,验证显示其成本低且加速效果显著,发布相关框架与检查点。
AI 大模型
检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。
Tevatron-Elastic:用于训练弹性检索器和重排序器的统一抽象
专题命中 检索器与排序 :retriever(abstract);分类 cs.CL
AI总结 Tevatron-Elastic提出统一抽象,可训练支持多种规模的检索器与重排序器,验证显示其成本低且加速效果显著,发布相关框架与检查点。
SkillReason:面向隐式用户请求的推理增强型智能体技能检索
专题命中 检索器与排序 :retriever(abstract);分类 cs.AI
AI总结 针对隐式用户请求的技能检索难题,提出两阶段框架SkillReason,结合推理增强训练,在SkillReason-Bench等三个基准上取得最优性能,缩小任务目标与技能能力的语义差距。
用于从网络威胁情报中提取攻击技术的检索约束策略优化
专题命中 检索器与排序 :retriever(abstract);分类 cs.CL
AI总结 研究针对CTI文本提取MITRE ATT&CK技术的挑战,提出两阶段框架TTP-R1,在四个CTI基准测试中F1值最优,子技术级F1超带检索增强的Claude Sonnet 4.5且推理速度更快
Comments Accepted to the AI Agent for Information Retrieval (Agent4IR) Workshop at KDD 2026
Gryphon-v2:替代级联的单一模型——带Rollout蒸馏的生成排序推荐系统
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 Gryphon-v2是替代多阶段级联推荐系统的单一模型,采用生成排序架构与Rollout蒸馏技术,在Yandex Music的在线实验中使活跃用户增1.41%且服务延迟相当。
面向LLM个性化协同写作的无训练令牌级引导
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL
AI总结 针对LLM个性化协同写作的需求,提出无训练框架SteerWrite,无需梯度更新即可适配专业领域,在多数据集、指标和模型上实现SOTA性能,大幅降低人工编辑工作量。
技能了解其邻居:用于技能检索的聚类对比能力页面
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 针对大语言模型智能体技能检索中仅改进检索器无法消除的文档导致的误差,提出聚类对比的能力页面,在SRA-Bench等数据集上显著提升了召回率与任务成功率。
Comments 16 pages, 4 figures
预测再检索:从视频前缀中进行跨实例未来状态检索
机构 * Centre for AI Research, VinUniversity(VinUniversity人工智能研究中心) ; National University of Singapore(新加坡国立大学)
专题命中 检索器与排序 :retriever(abstract);分类 cs.CL
AI总结 该研究提出PSR任务,构建含多数据集的基准,提出LFTR模型,发现预测而非感知是核心挑战,LFTR缩小差距且成本低,相关资源已公开。
Comments Work in progress
MutMem:持久智能体内存中的密码学授权突变
专题命中 检索器与排序 :retriever(abstract);分类 cs.AI
AI总结 本研究针对持久智能体内存的授权与防篡改问题,提出HOM-AIMOS中的MutMem协议,经实验验证其在多个基准任务中表现良好,可有效抵御中毒攻击。
Comments https://github.com/wallidsaydi-creator/HOM-AIMOS. 32 Pages
金融文档检索中的证据单元公平性与查询自适应稀疏-密集融合的局限性
专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.AI
AI总结 针对金融文档检索问题,在修正语料库后发现简单融合BM25与紧凑密集编码器为强基线,而三种轻量自适应查询加权路由均未取得统计可靠提升。
生成还是判断?基于范式视角的对话中基于大语言模型(LLM)的情感-原因对抽取
专题命中 检索器与排序 :retriever(abstract);分类 cs.CL
AI总结 该研究针对对话情感-原因对抽取,对比LLM的生成与判断范式,发现对级判断更优,引入辅助检索器后在三个数据集上实现F1提升,明确任务分解与候选范围的关键作用。
MemSFT:使用外部参数内存减轻对齐代价
机构 * Shanghai AI Laboratory(上海人工智能实验室) ; Tsinghua University(清华大学)
专题命中 检索器与排序 :retriever(abstract);分类 cs.CL
AI总结 研究针对大语言模型应用于特定领域产生的对齐代价问题,提出MemSFT方法,通过参数内存解耦领域专业化与主干参数更新,经多领域多模型评估,能提升领域性能且通用性能下降小,实现通用与专业能力解耦。
Comments 33 pages, 11 figures, 13 tables
Aethel:用于多跳金融尽职调查的可重现图检索框架
专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR
AI总结 针对二级私募股权交易中财务披露信息综合难题,Aethel框架结合二分个性化PageRank图检索等技术,将语料库建模为实体-段落图。在多跳金融尽职调查任务中,该框架在特定数据集上有较好表现,优势依赖语料库规模和实体索引质量,且发布相关工件保证可重现性。
Comments 11 pages, 3 figures, 2 tables. Includes evaluations on MuSiQue, 2WikiMultiHopQA, and a 4,123-chunk financial-disclosure corpus. Code and evaluation artifacts are available for reproducibility
超越记忆:一种用于异构协作知识工作的带大语言模型代理的模板化基础架构
机构 * University of Notre Dame(圣母大学)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 研究指出知识工作成果难传承,大语言模型代理无持久记忆。提出llm-wiki-memory-template,它是异构协作知识工作基础架构,沿多人类、多代理、多领域三个轴,通过案例研究展示其能保留失败路径等,解决负面结果丢失问题。
Comments 15 pages, 3 figures, 1 table
牢记于心:评估智能体记忆中的隐式关联盲点
机构 * University of Science and Technology of China(中国科学技术大学) ; Metastone Technology(元石科技)
专题命中 检索器与排序 :retriever(abstract);分类 cs.CL
AI总结 研究智能体记忆中的隐式关联盲点问题,引入InMind基准测试,通过配对控制区分三种解释,实验发现将记忆置于上下文时主干回答间接查询比例高,检索相同记忆时其他系统召回率低,诊断探针可缩小差距,指出路由是关键问题。
迈向神经信息访问中的相关性后验
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.IR
AI总结 研究现代信息检索系统中相关性操作的局限,提出将其理解为近似后验推理,扩展经典概率检索形式,通过显式似然 - 先验分解转移计算,纳入查询独立文档效用,经实验证明能提升检索效果并给出研究方向。
Comments SIGIR 2026 Perspectives Track
长法律文本的细粒度检索中的法律要点提取
专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR
AI总结 研究长法律文本检索难题,提出提取法律要点并嵌入索引进行检索的方法,在四个基准上评估,结果显示该方法对部分法学数据集有显著提升,对其他场景效果有别,证明法律要点在特定法学搜索中有用。
双注意力残差
专题命中 检索器与排序 :retriever(abstract);分类 cs.CL
AI总结 研究提出双注意力残差(DAR),通过相互跨流寻址将多流交互引入历史检索,在多个模型中优于标准残差Transformer和注意力残差,路由消融等分析表明其能保留深度多样性,避免冗余和功能不平衡。
Comments 13 pages, 10 figures, and 8 tables
探索性与同化性反思:用于长期记忆的反思性回忆循环
专题命中 检索器与排序 :retriever(abstract);分类 cs.AI
AI总结 研究基于大语言模型的自主智能体外部记忆问题,提出探索性 - 同化性反思(EAR)框架,结合探索性反思与同化性反思两种机制,提高初始检索性能和样本效率,在长期对话基准上比基线检索器提升检索率达 17.9%,且样本效率高、抗噪声反馈。
C$^2$KV:用于高效大语言模型推理的压缩可组合键值缓存重用
机构 * Alibaba Group(阿里巴巴集团)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL
AI总结 研究针对长上下文LLM推理成本高问题,提出C$^2$KV框架,联合优化KV提取与推理拼接,学习可组合压缩的KV缓存流形,引入轻量级边车提取器及协同训练策略,显著降低缓存成本,实现推理加速并保持生成质量。
Comments 12 pages, 9 figures, accepted by ACM SIGKDD 2026
从过载到洞察:人工智能代理如何支持科学家分析复杂数据
机构 * European XFEL(欧洲X射线自由电子激光设施)
专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI
AI总结 针对欧洲XFEL科学家分析复杂数据面临的挑战,设计并评估智能AI系统。采用设计科学研究方法,经多项研究开发并评估两原型,确定关键挑战,得出对AI代理的要求及设计建议,为开发可维护的AI支持提供指导。
Comments Accepted for publication at the 42nd IEEE International Conference on Software Maintenance and Evolution
科学声明-来源检索再探讨:风格迁移与重新排序的比较研究
专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR
AI总结 研究社交媒体科学声明源检索难题,对比稀疏和密集检索模型,发现翻译声明、纳入元数据、风格迁移及新型重新排序方法可提升检索性能,基于验证的重新排序效果最佳,MRR@5达0.758。
Comments Accepted at CLEF 2026 (Best of Labs)
云中可扩展的大语言模型智能体工具访问
机构 * Nanjing University(南京大学) ; Alibaba Cloud(阿里云) ; Fudan University(复旦大学) ; RMIT University(皇家墨尔本理工大学) ; Politecnico di Milano(米兰理工学院) ; Zhejiang University(浙江大学)
专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.AI
AI总结 研究大语言模型智能体在云环境下工具访问问题,提出云规模网关系统,通过打破直接连接模型等整合多种功能,实现高召回率、扩展工具访问数量、提高准确性并减少时间和令牌使用量,还分享了部署经验。
基于栖息地适应先验和kNN检索的多尺度ViT推理用于多物种植物识别
机构 * Georgia Institute of Technology(佐治亚理工学院)
专题命中 检索器与排序 :retriever(abstract);分类 cs.AI
AI总结 针对植被样方图像多物种植物识别难题,基于微调的DINOv2 ViT-L/14分类器,采用多尺度切片分解、kNN检索、栖息地适应降级等方法,在PlantCLEF 2026挑战赛中获第三名,私有排行榜宏F1为0.43902。
你会点击什么?基于偏好感知高光检索的个性化视频缩略图生成
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 研究针对视频平台个性化视频缩略图生成问题,提出两阶段框架,先通过偏好感知检索选取视觉锚点,再经VLM引导的扩散管道生成缩略图,实验和用户研究证明该方法性能优且能提升用户参与度。
BackgroundMellow:一种用于叙事驱动的丰富电影音效生成的多模态凝聚框架
机构 * Indian Institute of Technology Kharagpur(印度理工学院卡拉格布尔分校)
专题命中 检索器与排序 :retriever(abstract);分类 cs.AI
AI总结 多模态AI中为文本叙事生成电影音效困难,BackgroundMellow框架将其视为编排与信号处理问题,通过主 - 专家架构、Tango2模型、背景音乐检索器及NLP模块实现,经实验验证在时间同步等方面有效。
Comments 7 pages
大型行为模型:零售客户的可提示数字孪生体
机构 * Amity Research and Application Center (ARAC), Amity AI Holdings Co., Ltd.(友好研究与应用中心(ARAC),友好人工智能控股有限公司)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 研究旨在解决客户行为建模问题,提出大型行为模型(LBM),通过统一公式从零售交易学习客户决策,经多种训练方式优化。该模型在多任务中表现出色,消融研究揭示各因素作用,为客户数字孪生体和行为模拟提供可扩展基础。
Comments 17 pages, 5 figures
检索一个集合,而非独立段落:用于高效集合探索的集合级兼容性学习
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 针对多跳问答等任务中证据段落选择问题,提出集合级检索框架,通过查询-集合兼容性评分训练,用ParaSet和SetCE两个评分器实例化,提升了检索性能及下游问答任务性能,且集合级检索器有互补特性。
GORIO:基于NVMe-oF的图近似近邻搜索的以GPU为中心的远程I/O
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.DB
AI总结 研究针对图近似近邻搜索中大型向量索引超单GPU服务器内存问题,提出GORIO系统,将以GPU为中心的本地I/O扩展到远程存储,设计两层架构,实验表明其性能大幅提升。
MetaSkill-Evolve:基于双时间尺度元技能演化的大语言模型智能体递归自改进方法
机构 * LMU Munich(慕尼黑大学) ; The Chinese University of Hong Kong(香港中文大学) ; MCML ; MemAgents Lab(MemAgents实验室)
专题命中 检索器与排序 :retriever(abstract);分类 cs.AI
AI总结 针对现有自改进智能体演化非递归的局限,提出双时间尺度框架,任务技能与元技能分层递归演化,在三类基准上显著提升测试精度。
一种用于检测和解决自然语言需求中语用歧义的检索增强框架
机构 * Tata Consultancy Services(塔塔咨询公司)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 研究自然语言需求中的语用歧义,利用检索增强技术和不同领域知识库模拟不同专业利益相关者,生成候选消歧需求并验证,评估该方法在需求文档上的效果。