Open-Retrieval Conversational Question Answering
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.CL
Comments Accepted to SIGIR'20
AI 大模型
检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.CL
Comments Accepted to SIGIR'20
将BrowseComp-Plus映射到ClimbMix:构建更符合智能体搜索需求的真实语料库
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 该研究将BrowseComp-Plus的查询映射到NVIDIA的ClimbMix语料库,构建了与基准无关的映射流水线,生成57个有效查询,使智能体搜索难度向检索环节转移,发布了相关资源。
第一滴墨水:误导信息在长上下文推理中的非线性影响
机构 * Department of Computer Science ; Engineering, Texas A\&M University, College Station, TX, USA ; NVIDIA AI Technology Center, NVIDIA Corporation, Santa Clara, CA, USA
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 研究探讨了误导信息在长上下文推理中的非线性影响,发现误导信息比例增加时,性能在初期急剧下降,后续变化较小。通过理论和实证分析,揭示了误导信息对注意力的 disproportionate 影响,并指出过滤收益主要来自减少上下文长度而非去除误导信息。
ReasFlow:通过基于知识的多智能体系统助力应用数学中以推理为中心的科学发现
专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI
AI总结 针对理论驱动科学发现探索不足的问题,ReasFlow引入以推理为中心的自主智能体系统,通过内部验证循环和知识检索机制减少专家干预,能统一多项科研任务,从最少提示生成高质量论文,在开源基线中表现出色。
CABLE:通过基于互补前项的链接与扩展扩展记忆检索的覆盖范围
机构 * Shanghai Jiao Tong University(上海交通大学) ; Shanghai Innovation Institute(上海创新研究院)
专题命中 检索器与排序 :retriever(abstract);分类 cs.CL
AI总结 CABLE是一种插件式记忆检索增强模块,通过构建互补关联扩展检索覆盖范围,在多个模型和数据集上的系统级评估中提升了证据可及性的LLM评判分数。
Comments Accepted by COLM 2026
VisDocAgentBench:面向视觉丰富文档检索的智能体基准测试
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 该研究提出VisDocAgentBench基准,对比静态与智能体检索,发现视觉检索优于OCR文本检索,智能体可改善双桥项检索性能,为检索智能体发展提供方向。
基于大语言模型的生成式检索用于Snapchat内容推荐
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 该研究针对将预训练LLM转化为生成式检索器的挑战,设计了SnapLGR系统,通过三项核心优化实现了Snapchat短视频推荐效果的提升。
当工具支持的技能检索失效时:可执行能力检索中的源风格崩溃
机构 * University of Manchester(曼彻斯特大学) ; University of Sheffield(谢菲尔德大学) ; Shanghai University of Finance and Economics(上海财经大学)
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 该研究针对可执行能力检索中出现的源风格崩溃问题,提出源感知路由方法ToolScout,利用TF-IDF指纹提升检索覆盖率,验证了该方法的有效性。
LineageRAG:通过构建带源 grounding 的证据谱系来利用 GraphRAG
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.IR
AI总结 LineageRAG 针对现有 GraphRAG 未明确证据发现与源 grounding 关联的问题,构建带源 grounding 的证据谱系,在三个多跳问答数据集上较基线实现多项指标提升。
RAGas:结合持续知识整合的智能合约检索增强型 Gas 优化
机构 * School of Cyberspace Security, Hainan University(海南大学网络空间安全学院)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 针对智能合约 Gas 优化的需求,研究人员提出 RAGas 三阶段检索增强型生成框架,分析导致 Gas 过度使用的反模式,实验显示其可降低多达 11% 的 Gas 使用量,且检测精度和召回率较高。
Comments 14 pages, 3 figures
同步对数几率调控:面向真实场景的隐写术
机构 * Algoverse AI
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 本研究提出同步对数几率调控(SLS),一种无需发送方与接收方共享相同提示上下文的确定性隐写方案,通过代理提示编码有效载荷,在多数据集上验证其低 KL 散度、高信息密度及强隐蔽性,实现实用隐蔽通信。
ALKEMIE智能体:用于计算材料设计的自主平台
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 该研究针对材料计算工作流程碎片化的问题,提出集成多种技术的ALKEMIE智能体平台,通过多种材料相关应用验证其能力,并展望了该类平台的未来发展方向与挑战。
基于大语言模型和链式推理的智能AI框架用于无人机辅助物流调度与移动边缘计算
机构 * Nanyang Technological University(南洋理工大学) ; Singapore Institute of Technology(新加坡理工学院) ; Seatrium New Energy Laboratory(Seatrium 新能源实验室) ; Ministry of Education (MOE) Tier 1(教育部 Tier 1) ; Research Innovation and Enterprise (RIE) 2025 Industry Alignment Fund-Industry Collaboration Projects (IAF-ICP)(研究创新与企业 (RIE) 2025 行业对齐基金-行业合作项目 (IAF-ICP))
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 本文提出结合大语言模型和链式推理的智能AI框架,用于解决无人机辅助物流调度中的混合调度问题,通过分层深度强化学习实现无人机路由和任务执行优化,提升物流效率与任务完成率。
Comments 37 pages
S2Dialog:结合语义与声学风格建模的多模态对话检索
机构 * College of Computer Science, Inner Mongolia University(内蒙古大学计算机学院) ; University of Electronic Science and Technology of China, Shenzhen Campus(电子科技大学深圳校区)
专题命中 检索器与排序 :retriever(abstract);分类 cs.CL
AI总结 研究针对现有多模态对话检索方法无法捕捉对话全局语义与风格一致性的问题,提出S2Dialog框架,结合对话级文本与声学检索器及对比学习,在DailyTalk数据集上实现出色检索性能。
SkillSight:通过共享描述实现准确技能检索
专题命中 检索器与排序 :retriever(abstract);分类 cs.AI
AI总结 研究针对大语言模型智能体技能检索问题,提出SkillSight框架,通过语义和词汇空间校准共享背景,减少偏差,实验证明该方法能提升检索指标,在端到端评估中表现出色且速度快,实现准确高效的技能选择。
Comments 9 pages, 4 figures
基于排名感知奖励最大化的查询嵌入测试时优化
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 本研究提出TTT-Embed框架,将排名奖励提炼为轻量学习向量,无需访问模型权重即可优化,在多嵌入模型和MTEB任务上显著提升测试时检索效果,且具备良好泛化性,解决了灾难性遗忘问题。
潜在事实核查:通过激活工程检测虚假信息
机构 * PUCRS(巴西天主教大学(里约格兰德 do 苏里)) ; Kunumi Institute(库纳米研究所)
专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.CL
AI总结 本研究提出基于激活工程的虚假信息检测框架,通过对比激活引出潜在空间的虚假信息方向,在多类模型和基准上实现了优于部分基线的检测性能,为可解释性驱动的虚假信息检测提供了新方向。
Comments 13 pages
自然语言处理:从分词到RLHF的全面实用指南
机构 * KAZAN (VOLGA REGION) FEDERAL UNIVERSITY INSTITUTE OF COMPUTATIONAL MATHEMATICS AND INFORMATION TECHNOLOGIES(卡赞(伏尔加地区)联邦大学计算数学与信息科技学院)
专题命中 检索器与排序 :retrieval augmented generation(abstract);分类 cs.CL
AI总结 本文系统指导现代NLP全流程,涵盖分词、向量化、大语言模型微调、检索增强生成及人类反馈强化学习,强调低资源语言处理与开源模型应用。
Comments 136 pages, 12 practical works, preprint. Textbook for senior undergraduates and graduate students. Original contributions on low-resource languages (Tajik, Tatar and other). Companion repository available
Foam-Agent:迈向自动化智能CFD工作流程
机构 * Department of Computer Science, Rensselaer Polytechnic Institute(里士满理工学院计算机科学系) ; Department of Mechanical, Aerospace, and Nuclear Engineering, Rensselaer Polytechnic Institute(里士满理工学院机械、航空航天与核工程系) ; Department of Computer Science and Engineering, University of California San Diego(加州大学圣地亚哥分校计算机科学与工程系) ; College of Education, Zhejiang Normal University(浙江师范大学教育学院) ; School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 Foam-Agent通过多智能体框架和大型语言模型,实现自动化CFD工作流程,显著提升模拟效率和成功率。
Comments 34 pages, 9 figures, 9 tables
Journal ref Computer Methods in Applied Mechanics and Engineering, Vol. 461, 119271 (2026)
构建动态主逻辑模型作为知识图谱,用于使用检索增强大语言模型的复杂系统诊断
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 本研究提出基于检索增强大语言模型的KG-DML框架,实现了复杂系统动态主逻辑模型的自动化构建,经低压冷却剂注入系统验证,可转化技术文档为可执行功能模型用于诊断分析。
Comments 36 Pages, 8 Figures
VAKRA:评估工具使用策略下跨API与检索的多跳推理能力
机构 * IBM(国际商业机器公司(IBM))
专题命中 检索器与排序 :knowledge retrieval(abstract_cn);分类 cs.AI
AI总结 本研究推出VAKRA基准评估工具使用策略下跨API与检索的多跳推理,发现现有最优模型在相关任务上性能随推理深度显著下降,失败集中于语言介导推理环节。
LoongReflect:通过全局视角蒸馏提升搜索智能体的长程反思能力
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 LoongReflect是将反思表述为记忆控制策略的训练框架,通过双信号通道结合全局视角蒸馏与结果导向GRPO优化,在多跳检索增强生成和数学推理任务上提升了搜索智能体的长程反思能力。
Comments 15 pages, 8 figures
内存管理的长上下文注意力:可编辑请求局部记忆的初步研究
机构 * Zjydiary(智纪日记)
专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.CL
AI总结 提出一种混合架构,将快速循环或稀疏骨干与可编辑的请求局部记忆槽和查询时稀疏回退相结合,以解决长上下文模型中的记忆写入、覆盖和抗污染问题。
Comments 16 pages, 11 figures, 5 tables. Substantially rewritten v3: retitled and reframed as MMLA; adds an eventized architecture, trusted row assembly, hard atomic overwrite/NULL, claim-evidence mapping, PM-I2 negative results, stop rules, and a conditional roadmap. Preserves the original Llama budget-gate failure. Project: https://github.com/MMLA-org/mmla-memory
增强本地大语言模型代理的Linux提权攻击能力
机构 * TU Wien(维也纳技术大学)
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI
AI总结 本文研究通过系统性实验验证针对性干预能否提升本地开源模型在Linux提权中的性能,发现开源模型可匹配甚至超越云模型,且反思类干预效果最佳,但漏洞发现仍是本地模型的瓶颈。
Comments Accepted at RAISE workshop (https://raise-workshop.github.io/)
InSight-doc:面向长文档理解的智能体视觉感知框架
机构 * The Hong Kong University of Science and Technology(香港科技大学) ; Huawei(华为)
专题命中 检索器与排序 :retriever(abstract);分类 cs.CL
AI总结 本研究提出智能体视觉感知框架InSight-doc,通过自适应选择放大高分辨率区域处理长文档,经SFT+RL训练后在文档VQA任务中显著提升准确率、降低幻觉与推理延迟,相关资源已公开。
VeriForge:通过混合式主动脚手架缓解叙事创作中的潜在知识缺口
专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL
AI总结 VeriForge是混合式主动写作系统,通过主动内联高亮、双流查询、空间知识画布三种机制,帮助作者识别叙事创作中的潜在知识缺口,提升领域知识整合能力,获用户与专家认可。
Comments 14 pages, 5 figures, Accepted by UIST'26
从相关性到执行效用:面向基于技能的大语言模型智能体的奖励感知动态执行门控
机构 * Tongji University(同济大学) ; The University of Sydney(悉尼大学) ; University of Science and Technology of China(中国科学技术大学) ; Nankai University(南开大学) ; Johns Hopkins University(约翰斯·霍普金斯大学) ; City University of Hong Kong(香港城市大学) ; University of Surrey(萨里大学)
专题命中 检索器与排序 :retriever(abstract);分类 cs.AI
AI总结 针对基于技能的LLM智能体执行决策难题,提出RADEG轻量型决策层,通过学习代理模型预测执行效用,在288个rollout的评估中减少不必要执行并优于基线方法
PreGress:面向图节点排序的原生排序预训练与提示学习框架
专题命中 检索器与排序 :retrieval augmented generation(abstract);分类 cs.IR
AI总结 PreGress是首个原生排序预训练与提示学习框架,通过多任务预训练与轻量提示模块,在低开销下实现了多节点排序任务的优异性能。
面向时序检索的推理视图难度门控融合
专题命中 检索器与排序 :retriever(abstract);分类 cs.IR
AI总结 该研究针对时序检索中多改写视图融合的精度问题,提出查询难度门控的推理视图融合方法,在Tempo基准上提升了6种检索器的性能,且增益显著。
Comments Accepted at CIKM 2026
Tevatron-Elastic:用于训练弹性检索器和重排序器的统一抽象
专题命中 检索器与排序 :retriever(abstract);分类 cs.CL
AI总结 Tevatron-Elastic提出统一抽象,可训练支持多种规模的检索器与重排序器,验证显示其成本低且加速效果显著,发布相关框架与检查点。