NumColBERT: Non-Intrusive Numeracy Injection for Late-Interaction Retrieval Models
NumColBERT:非侵入性数值注入用于后期交互检索模型
专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR
AI总结 NumColBERT通过非侵入性方法提升包含数值条件的检索性能,保留原有机制并引入数值门控机制和对比学习目标,实验表明其优于传统微调基线。
AI 大模型
检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。
NumColBERT:非侵入性数值注入用于后期交互检索模型
专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR
AI总结 NumColBERT通过非侵入性方法提升包含数值条件的检索性能,保留原有机制并引入数值门控机制和对比学习目标,实验表明其优于传统微调基线。
治理人工智能辅助的安全运营:一种用于操作决策支持的设计科学框架
机构 * Department of Artificial Intelligence, University of the Cumberlands(人工智能系,坎伯兰大学) ; Department of Management Information Systems, University of Illinois Springfield(管理信息系统系,伊利诺伊大学斯普林菲尔德分校)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 本文提出了一种设计科学框架,用于在高风险数字基础设施中管理人工智能辅助的操作决策支持,通过定义设计提案、角色问责制、成熟阶段、质量门禁、评估标准和证据边界。
Comments 28 pages, 1 listing, 1 figure, 20 Tables
MILD:具有双向感知和多层对齐的中介代理系统用于人车协作
机构 * Department of Civil Engineering, McGill University(麦吉尔大学土木工程系) ; Systems Hub, The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)系统中心) ; Interdisciplinary Centre for Security, Reliability and Trust, University of Luxembourg(卢森堡大学安全、可靠与信任跨学科中心)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 本文提出MILD系统,通过双向感知和多层对齐提升人车协作效率,采用ECPO算法确保策略符合安全规范和人类价值观,实验证明其在感知准确性和策略质量上优于基线模型。
基于Voronoi单元的原理化令牌修剪方法:用于晚期交互检索模型
专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR
AI总结 本文提出基于超空间几何的Voronoi单元方法,用于原理化修剪晚期交互检索模型中的令牌嵌入,通过保留检索质量的同时减少索引存储开销。
Comments Accepted at SIGIR 2026 Full Paper Track; 11 pages; 7 figures
MLAIRE: 多语言语言感知信息检索评估协议
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.IR
AI总结 本文提出MLAIRE评估协议,用于评估多语言信息检索中语言感知维度,引入语言偏好率和Lang-nDCG等指标,分析语义检索与查询语言偏好之间的差异。
检索头是动态的
机构 * Michigan State University(密歇根州立大学) ; Zoom Communications(Zoom公司) ; Tongyi Lab, Alibaba Group(阿里云实验室)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL
AI总结 本文从动态视角研究LLM中的检索头,揭示其时间动态性、不可替代性及与隐藏状态的关联,通过实验验证动态检索头在生成任务中的优势。
Comments Accepted at ACL 2026
基于FPGA的加速器的LLM驱动的设计空间探索
机构 * School of Computing Science, University of Glasgow(格拉斯哥大学计算机科学学院)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 本文提出SECDA-DSE框架,利用大语言模型自动化FPGA加速器的设计空间探索,通过结构化探索器和LLM栈实现高效配置生成与优化。
Comments Accepted to the Workshop on Intelligent System Design (InSyDe) co-located with EuroSys '26
SkillRet:一种大规模技能检索基准,用于LLM代理
机构 * ThakiCloud
专题命中 检索器与排序 :retriever(abstract);分类 cs.AI
AI总结 本文提出SkillRet基准,用于评估LLM代理中的技能检索。该基准包含17810个公开技能,提供63259个训练样本和4997个评估查询,通过任务特定微调显著提升了检索性能。
XTR算法的可重复性研究
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 本文复现了XTR算法及其训练目标,扩展至知识蒸馏和高效检索引擎,发现XTR在某些场景下不如ColBERT有效,但提升了IVF检索效率。
Comments 8 pages, 4 figures, 3 tables
BlenderRAG: 通过检索增强的代码合成实现高保真的3D物体生成
机构 * University of Bologna(博洛尼亚大学) ; Ferrari S.p.A.(法拉利公司)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 BlenderRAG通过检索增强的代码合成方法,利用500个专家验证的多模态数据集提升Blender代码生成的准确性和一致性,无需微调或专用硬件。
重现面向推理的自适应重排序
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 本文通过重现GAR在需要推理的检索基准上的表现,改进了重排序过程,提升了推理密集型检索的效果,同时保持了较低的计算开销。
Comments 7 figures, 11 pages
ProMax:探索基于分布塑造的LLM衍生资料在推荐系统中的潜力
专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR
AI总结 本文提出ProMax框架,通过分布塑造技术提升推荐系统性能,利用用户和物品资料的协同关系,改进推荐模型对未见物品的偏好学习。
Comments 11 pages, 8 figures, accepted by SIGIR 2026
从非结构化文本自动生成本体:一种多智能体LLM方法
机构 * Rensselaer Polytechnic Institute(拉特格斯理工学院)
专题命中 检索器与排序 :retrieval augmented generation(abstract);分类 cs.AI
AI总结 本文提出一种多智能体LLM方法,通过领域特定保险合同实验,验证了在本体生成中规划优先、任务驱动的架构能提升结构质量和查询性。
上下文工程的根定理
机构 * Independent Researcher(独立研究者)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL
AI总结 本文提出上下文工程的根定理,通过形式化约束推导出信号-token比最大化原则,揭示了连续对话系统中信息质量退化与上下文窗口限制的本质规律。
Comments 17 pages, 2 figures
通过合成的分步监督增强代理文本图检索
机构 * Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学) ; Peking University(北京大学) ; School of Information, Renmin University of China(中国人民大学信息学院) ; Harbin Institute of Technology(哈尔滨工业大学) ; North China Electric Power University(华北电力大学) ; GDS Holdings Limited(GDS控股有限公司)
专题命中 检索器与排序 :retriever(abstract);分类 cs.CL
AI总结 本文提出一种基于LLM的文本图检索框架,通过合成分步监督优化检索过程,提升复杂图基问答任务的准确性和F1分数。
基于ECLASS的语义产品搜索增强
专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR
AI总结 本文提出利用LLM密集检索和ECLASS层次语义提升电子元件语义搜索效果,实验显示其在准确率和效率上均优于传统方法。
双视训练用于遵循指令的信息检索
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 本文提出双视数据合成策略,通过极性反转生成互补指令,使检索系统能重新评估候选集以满足指令要求,从而在FollowIR基准上提升45%性能。
Mira-Embeddings-V1:基于LLM合成数据的领域适应语义重排序用于招聘
机构 * OpenJobs AI
专题命中 检索器与排序 :retriever(abstract);分类 cs.CL
AI总结 本文提出Mira-Embeddings-V1,通过LLM合成数据重塑嵌入空间并纠正边界混淆,提升招聘领域召回率和精度。
STRIDE: 用于检索增强多跳问答的策略迭代决策
机构 * University of Science ; Technology of China \& State Key Laboratory of Cognitive Intelligence Hefei Anhui China ; Technology of China \& State Key Laboratory of Cognitive Intelligence
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 STRIDE通过分离战略规划、动态控制和 grounded 执行,解决多跳问答中实体早 Commit 和推理依赖缺失的问题,提升推理鲁棒性与准确性。
Comments Accepted by SIGIR 2026 Full Paper. The code repository is available at https://github.com/fanshu6hao/STRIDE
通过不对称编码器评估并实现高效的中文医疗检索
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 本文提出CMedTEB基准,结合检索、重排序和语义文本相似性任务,引入CARE不对称检索器,通过两阶段训练策略提升性能,实现高效医疗检索。
Comments 21 pages, 4 figures. Accepted by ACL 2026
计算机科学中的系统综述集合
专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR
AI总结 本文提出SR4CS,一个包含1212个计算机科学系统综述的大型数据集,用于评估布尔查询生成、检索和筛选的可重复研究,揭示不同检索方法的精度、召回率差异及零样本生成的局限性。
Comments Accepted at SCOLIA26 Workshop
通过联合语义相关性和行为参与建模实现沃尔玛赞助搜索检索的统一监督
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 本文提出一种基于语义相关性和行为参与的统一监督框架,通过结合语义标签、检索先验分数和用户参与信号,提升沃尔玛电子商务赞助搜索检索性能。
Comments Accepted to SIGIR 2026, Industry Track
谁的事实获胜?在知识冲突下LLM的来源偏好
机构 * Heidelberg University(海德堡大学) ; Heidelberg Institute for Theoretical Studies(海德堡理论研究所)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL
AI总结 研究探讨了LLM在知识冲突中的来源偏好,发现其更倾向于机构证实的信息,但可通过重复低可信度来源信息逆转。提出方法减少重复偏差,同时保持大部分偏好。
Comments Data and code: https://github.com/JaSchuste/llm-source-preference
BarrierBench: 评估大型语言模型在动态系统安全验证中的性能
机构 * Isfahan University of Technology(伊斯法罕技术大学) ; Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所) ; University of Colorado Boulder(科罗拉多大学博尔德分校)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 本文提出BarrierBench基准,评估大型语言模型在动态系统安全验证中的能力,通过100个动态系统案例测试语言模型在生成安全证书和协调策略中的有效性。
Comments 8th Annual Learning for Dynamics & Control Conference
重组上下文:RoPE扰动的自我蒸馏用于长上下文适应
机构 * Georgia Institute of Technology(佐治亚理工学院) ; Microsoft(微软)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL
AI总结 本文提出RoPE扰动的自我蒸馏方法,通过扰动RoPE索引生成不同视角的训练序列,提升模型对位置变化的鲁棒性,实验显示在长上下文任务中表现更优。
AMA:通过多智能体协作实现自适应记忆
机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) ; Shandong University(山东大学) ; Nanyang Technological University(南洋理工大学) ; Southern University of Science and Technology(南方科技大学)
专题命中 检索器与排序 :retriever(abstract);分类 cs.AI
AI总结 本文提出AMA框架,通过多智能体协作实现自适应记忆管理,解决传统方法在记忆粒度和一致性维护上的不足,实验表明其在长上下文任务中表现优异,减少约80%的token消耗。
Comments 8 pages
缓解生成检索中协同语义ID过时问题
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 本文提出轻量级、模型无关的SID对齐更新方法,解决时间漂移导致的SID过时问题,提升检索性能并降低训练计算量。
Comments Accepted at SIGIR 2026. This version corresponds to the accepted manuscript
Kwame 2.0:面向非洲大规模在线编程教育的人机协同生成式AI助教
机构 * ETH Zurich, Switzerland(苏黎世联邦理工学院,瑞士) ; Charité - Universitätsmedizin Berlin, Germany(柏林夏里特医学院,德国) ; Kwame AI Inc., U.S.(Kwame人工智能公司,美国)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL
AI总结 Kwame 2.0通过检索增强生成技术,在非洲35个国家的15个班级中为3717名学生提供及时准确的学习支持,结合人类监督和社区参与,有效提升编程课程的教学质量。
Comments 8 pages, Accepted at the 27th International Conference on Artificial Intelligence in Education (AIED 2026)
OctoTools: 一个具有可扩展工具的代理框架,用于复杂推理
机构 * Stanford University(斯坦福大学)
专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.CL
AI总结 OctoTools通过标准化工具卡、规划器和执行器,提供一种无需训练的多代理框架,实现跨领域复杂推理,其在16种任务中达到9.3%的平均准确率提升。
Comments 88 pages, 18 figures. Accepted to ACL 2026
CHAIRO:面向LLMs的上下文分层类比归纳与推理优化
机构 * National Engineering Laboratory for Big Data System Computing Technology(国家大数据系统计算技术工程实验室) ; Shenzhen University(深圳大学) ; Tsinghua University(清华大学) ; National University of Singapore(新加坡国立大学)
专题命中 检索器与排序 :RAG(abstract);分类 cs.AI
AI总结 本文提出CHAIRO框架,通过类比示例提升规则归纳和决策可靠性,在内容审核中实现更准确和可解释的规则生成。
Comments Accepted to ACL 2026 main conference; under official publication process