arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 349 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 349 篇

2607.27136 2026-07-30 cs.IR 新提交 70%

KAMR: Grounding Generation via Knowledge-Aligned Multi-hop Retrieval

KAMR:基于知识对齐多跳检索的接地生成

Xiaochen Wang, Yuan Zhong, Haoyu Wang, Ting Wang, Fenglong Ma

专题命中 检索器与排序 :retrieval-augmented generation(abstract);retriever(abstract);分类 cs.IR

AI总结 该研究针对多跳检索中三元组排序与监督缺失问题,提出KAMR知识对齐多跳检索器,通过构建部分对齐数据集优化对比目标,在多基准与LLM主干上提升了多跳检索和下游问答性能。

Comments Accepted by COLM'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16848 2026-07-21 cs.LG cs.AI 新提交 70%

Beyond Memory Leaderboards: Evaluating Scientific Memory as Budgeted Context Restoration

超越内存排行榜:将科学记忆评估为预算上下文恢复

Maksim Sheverev, David Finkelstein, Sergey Nikolenko

机构 * Quantellence Research(Quantellence研究公司) St. Petersburg Department of the Steklov Institute of Mathematics(斯捷克洛夫数学研究所圣彼得堡分部) St. Petersburg State University(圣彼得堡国立大学)

专题命中 检索器与排序 :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 研究提出两个全文科学记忆基准测试PAIM和PTr,评估八个内存/检索系统,发现内存排行榜受多种因素影响,如摄取粒度等。结果显示不同系统表现因条件而异,还表明大语言模型评判排名与人工一致,应将科学记忆评估为预算上下文恢复并开源相关资源。

Comments 40 pages, 6 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16603 2026-07-21 cs.CL 新提交 70%

NOWJ@COLIEE 2026: Adaptive Pipelines for Legal Retrieval and Reasoning

NOWJ@COLIEE 2026:用于法律检索和推理的自适应管道

Thuong-Hieu Ngo, Hoang-Trung Nguyen, Huu-Dong Nguyen, Xuan-Bach Le, Le-Dung Nguyen, Quang-Thanh Tran, Ha-Thanh Nguyen, Thi-Hai-Yen Vuong

机构 * VNU University of Engineering and Technology(越南国立工程技术大学) Center for Juris-Informatics, ROIS-DS College of Engineering & Computer Science, VinUniversity(越南Vin大学工程与计算机科学学院法律信息学中心)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);dense retrieval(abstract);分类 cs.CL

AI总结 NOWJ团队参与COLIEE 2026竞赛五项任务,针对各任务提出不同方法。如任务1的四阶段管道,任务2的多种方法结合,任务3的检索增强框架等,通过这些方法在法律检索、推理等方面取得相应成果。

Comments Presented at COLIEE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07858 2026-07-10 cs.AI cs.LG 新提交 70%

Agentic AI and Retrieval-Augmented Models in Straight-Through Underwriting

直通式承保中的智能体人工智能与检索增强模型

Robert Richardson, Josh Meyers, Brian Hartman, David Sandberg

机构 * Brigham Young University

专题命中 检索器与排序 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 研究人工智能在精算实践中的应用,开发用于小型商业企业主保单直通式承保的智能体人工智能框架,通过构建实验环境比较三条承保管道,发现智能体系统总体表现最佳,在特定场景中优势明显。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04043 2026-07-07 cs.IR 新提交 70%

Claim2Source at CheckThat! 2026: Improving Multilingual Scientific Claim-Source Retrieval with Verification-based Re-Ranking

CheckThat! 2026中的Claim2Source:基于验证的重新排序改进多语言科学声明-来源检索

Tobias Schreieder, Harsh Khandelwal, Yu-Ling Zhong, Michael Färber

专题命中 检索器与排序 :retriever(abstract);dense retrieval(abstract);分类 cs.IR

AI总结 针对多语言科学声明-来源检索任务,提出多阶段检索框架,结合结构化表示与渐进候选优化,采用双语声明、元数据增强源表示及语言适配,经多步检索提升性能,在比赛中获佳绩。

Comments Accepted at the CheckThat! Lab at CLEF 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03028 2026-07-07 cs.IR 新提交 70%

HETERQA: Benchmarking Record Retrieval over Multiple Heterogeneous Sources

HETERQA:多异构源记录检索基准测试

Yaodong Su, Hanchang Li, Quanqing Xu, Chuanhui Yang, Yixiang Fang

专题命中 检索器与排序 :RAG(abstract);hybrid retrieval(abstract);分类 cs.IR

AI总结 研究新兴系统中多异构源记录检索问题,构建含857个问答对的HETERQA基准,采用答案驱动方式,经多步操作生成,验证基准并评估多种检索器,为异构源记录检索提供有效测试平台。

Comments 20 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01538 2026-07-03 cs.CL 新提交 70%

Can Language Models Actually Retrieve In-Context? Drowning in Documents at Million Token Scale

语言模型真的能进行上下文检索吗?在百万Token规模的文档中淹没

Siddharth Gollapudi, Nilesh Gupta, Prasann Singhal, Sewon Min

机构 * UC Berkeley(加州大学伯克利分校) UT Austin(得克萨斯大学奥斯汀分校)

专题命中 检索器与排序 :retriever(abstract);dense retrieval(abstract);分类 cs.CL

AI总结 本文首次系统研究百万Token语料库上的上下文检索,提出0.6B参数的BlockSearch模型,通过注意力稀释分析引入长度感知调整,在MS MARCO和NQ上匹配稠密检索,在LIMIT上得分高出3倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26346 2026-06-26 cs.AI 新提交 70%

How Do Tool-Augmented LLM Agents Perform on Real-World Energy Analytics Tasks?

工具增强的LLM智能体在真实世界能源分析任务中的表现如何?

David Akinpelu, Akintonde Abbas, Rereloluwa Alimi, Ayodeji Lana

机构 * Independent Researcher(独立研究员) Tume AI

专题命中 检索器与排序 :retrieval-augmented generation(abstract);knowledge retrieval(abstract);分类 cs.AI

AI总结 针对能源领域缺乏智能体评估基准的问题,构建了包含243个专家策划问题的测试环境,评估工具增强的LLM智能体在数据检索、知识解释和定量建模三类任务上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21649 2026-06-26 cs.CL 新提交 70%

EvoEmbedding: Evolvable Representations for Long-Context Retrieval and Agentic Memory

EvoEmbedding: 面向长上下文检索与智能体记忆的可演化表示

Chang Nie, Chaoyou Fu, Junlan Feng, Caifeng Shan

机构 * Nanjing University(南京大学)

专题命中 检索器与排序 :RAG(abstract,abstract_cn);分类 cs.CL

AI总结 提出EvoEmbedding模型,通过持续更新的潜在记忆生成可演化嵌入,实现基于动态上下文的检索,在长上下文基准上超越更大规模模型,并泛化到下游任务。

Comments Project Page: https://clare-nie.github.io/EvoEmbedding

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25622 2026-06-25 cs.CR cs.AI 新提交 70%

Probabilistic Agents in Deterministic Audits: Evaluating Multi-Agent Systems for Automated Audits Based on the German IT-Grundschutz

确定性审计中的概率性智能体:基于德国IT-Grundschutz的自动化审计多智能体系统评估

Lea Roxanne Muth, Marian Margraf

机构 * Department of Mathematics and Computer Science(数学与计算机科学系) Freie Universität Berlin(柏林自由大学)

专题命中 检索器与排序 :retrieval augmented generation(abstract);hybrid retrieval(abstract);分类 cs.AI

AI总结 提出结合混合检索增强生成的多智能体系统架构,通过假设验证循环和解耦推理流水线部分自动化IT-Grundschutz认证,实验表明在语义任务上高效但在逻辑推理阶段受限于LLM的概率性。

Comments Accepted for publication at the 2026 IEEE International Systems Conference (SysCon), Halifax, NS, Canada, April 6-9, 2026. 8 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13814 2026-06-25 cs.IR 新提交 70%

TASR: Training-Free Adaptive Stopping for Iterative Retrieval

TASR:无需训练的迭代检索自适应停止规则

Adrian Kieback, Uyiosa Philip Amadasun, Aman Chadha, Aaron Elkins

专题命中 检索器与排序 :retrieval-augmented generation(abstract);retriever(abstract);分类 cs.IR

AI总结 提出TASR,一种无需训练的迭代检索停止规则,通过重复答案检测和逻辑回归边际阈值减少冗余检索,在多种配置下保持高F1值并降低调用次数。

Comments 20 pages, 5 figures. Accepted at Agent4IR Workshop, KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09520 2026-06-23 physics.chem-ph cs.AI 新提交 70%

Closing the Prior-Posterior Loop: Self-Reflective Molecular Design with Analysis-Driven LLM Iteration

闭合先验-后验循环:基于分析驱动LLM迭代的自反性分子设计

Junyi Gong, Zijie Qiu, Ben Zhong Tang

机构 * Faculty of Chemistry, Shenzhen MSU-BIT University(深圳MSU-BIT大学化学学院) School of Science and Engineering, Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳)科学与工程学院) Department of Chemistry, Hong Kong University of Science and Technology(香港科技大学化学系)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

AI总结 提出一种自反性分子设计框架,用第一性原理计算的完整物化理由替代标量反馈,使LLM从随机采样器转变为因果推理器,在HOMO-LUMO能隙任务中实现0.0003 eV偏差和100%成功率。

Comments 3 tables, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06545 2026-06-08 cs.SE cs.AI 新提交 70%

Queen-Bee Agents: A BeeSpec-Centered Architecture for Governed Enterprise MCP Orchestration

蜂后智能体:一种以BeeSpec为中心的受治理企业MCP编排架构

Dutao Zhang, Liaotian

机构 * Polytechnic University(理工学院)

专题命中 检索器与排序 :retriever(abstract);hybrid retrieval(abstract);分类 cs.AI

AI总结 提出Queen-Bee多智能体架构,通过Queen控制平面检索能力、规划任务并编译BeeSpec,由Bee智能体在受限工具访问下执行,实现策略执行、租户隔离和边界内执行,在59个企业任务中达到0.964成功率且零治理失败。

Comments Technical report. Prototype-level systems evidence; 59 enterprise-style tasks

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08994 2026-08-11 cs.IR cs.AI cs.CL cs.LG 新提交 67%

Guardian Crawler: Retrieval-First Knowledge Discovery with Bounded LLM Augmentation for Noisy Web Intelligence

Guardian Crawler:面向噪声网络智能的、结合受限大语言模型增强的检索优先型知识发现方法

Joshua Castillo, Santosh Nukavarapu, Ravi Mukkamala

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 Guardian Crawler是面向噪声网络智能的检索优先型测试平台,结合BM25与风险感知重排序等技术,在合成语料库实验中取得较高检索分数,可用于知识发现与证据摘要生成。

Comments 8 pages, 2 figures. Accepted as a Short Paper at KDIR 2026 (International Conference on Knowledge Discovery and Information Retrieval)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24800 2026-07-29 cs.IR cs.AI cs.CL 新提交 67%

When Thinking Before Retrieval Hurts: TraceBound Diagnostics for Adaptive Knowledge-Graph Retrieval

当检索前思考有害时:用于自适应知识图谱检索的TraceBound诊断

Partha Sarathi Purkayastha

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 研究知识图谱自适应检索中“检索前思考”有害问题,引入TraceBound诊断协议,它能暴露查询配置文件等。实验表明虽改善可检查性,但降低检索质量,通过分析定位退化原因,指出应将其作为动作选择控制问题评估。

Comments 11 pages, 4 figures, 15 tables. Accepted at the Failure Modes in Agentic AI (FAGEN) Workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10994 2026-07-14 cs.LG 新提交 67%

A Multi-Agent Framework for Zero-Dimensional Reduced-Order Model Planning

用于零维降阶模型规划的多智能体框架

Bingteng Sun, Hao Yin, Yiling Chen, Renjie Xiao, Lei Xie, Shanyou Wang, Ruonan Wang, Shubao Chen, Qingzong Xu, Lin Lu, Qiang Du, Junqiang Zhu

机构 * Institute of Engineering Thermophysics, Chinese Academy of Sciences(中国科学院工程热物理研究所) National Key Laboratory of Science and Technology on Advanced Light-duty Gas-turbine(先进轻型燃气轮机技术重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Qingdao Institute of Aeronautical Technology(青岛航空技术研究院) Nanjing Future Energy System Research Institute(南京未来能源系统研究院)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文针对复杂零维降阶模型规划中依赖人工、传统方法局限等问题,提出多智能体架构Z-COPA,其核心是专用图表示法,将规划转化为图结构优化问题,经多基准测试验证,该框架性能卓越且打破传统范式,提供新规划技术方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07383 2026-07-09 cs.CV 新提交 67%

MMAgent-R$^2$: Learning to Rerank and Reject for Agentic mRAG

MMAgent-R$^2$:用于智能mRAG的重排与拒绝学习

Tao Zhang, Ziqi Zhang, Zongyang Ma, Yuxin Yang, Bing Li, Chunfeng Yuan, Kang Rong, Fengyun Rao, Jing Lyu, Weiming Hu

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, CASIA(中国科学院复杂系统管理与控制国家重点实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Beijing Key Laboratory of Super Intelligent Security of Multi-Modal Information(北京多模态信息超智能安全重点实验室) WeChat Vision, Tencent Inc.(腾讯微信视觉团队) PeopleAI Inc.(人智公司) School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)

专题命中 检索器与排序 :retrieval augmented generation(abstract);retriever(abstract)

AI总结 针对KB-VQA中现有mRAG方法在处理视觉相似实体时的不足,提出MMAgent-R$^2$框架,集成视觉重排和主动拒绝机制,设计复合奖励函数,经GRPO训练实现联合优化,实验证明其在多任务中性能达最优。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05968 2026-07-08 cs.CL cs.AI cs.IR 新提交 67%

InfluMatch: Frontier-Quality KOL Search at 4B-Model Cost

InfluMatch:以4B模型成本实现前沿质量的关键意见领袖搜索

Krittanon Kaewtawee, Petmongkon Pornpichitsuwan, Natchaya Temyingyong, Nutnicha Laplamoon, Wachiravit Modecrua, Krittin Pachtrachai, Touchapon Kraisingkorn

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 研究如何将关键意见领袖与泰国营销标准匹配,提出低成本三阶段级联InfluMatch,由小型开放权重模型构建,能以低得多的成本达到前沿模型效果,是可部署、可解释的KOL搜索系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00798 2026-07-02 cs.CV 新提交 67%

ClinRAG-GRAPH: Clinical-prior Retrieval-Augmented Graph Model with Domain Adversarial Learning for Breast pCR Prediction

ClinRAG-GRAPH: 基于临床先验的检索增强图模型与领域对抗学习用于乳腺癌pCR预测

Yaofei Duan, Yuhao Huang, Tianyu Zhang, Yuan Gao, Luyi Han, Xin Wang, Xinyu Xie, Xinglong Liang, Chunyao Lu, Muzhen He, Patrick Pang, Yue Sun, Ning Mao, Tao Tan, Ritse Mann

机构 * Department of Medical Imaging, Radboud University Medical Center, Nijmegen, The Netherlands(拉德堡德大学医学中心医学影像科,奈梅亨,荷兰) The Netherlands Cancer Institute, Amsterdam, The Netherlands(荷兰癌症研究所,阿姆斯特丹,荷兰) Faculty of Applied Sciences, Macao Polytechnic University, Macau, China(澳门理工大学应用科学学院,澳门,中国) Boston Children’s Hospital, Harvard Medical School, Boston, USA(波士顿儿童医院,哈佛医学院,波士顿,美国) Centre for Artificial Intelligence and Robotics, Hong Kong Institute of Science & Innovation, Chinese Academy of Sciences, Hong Kong, China(中国科学院香港创新研究院人工智能与机器人创新中心,香港,中国) Imaging Division, University Medical Center Utrecht, Utrecht, The Netherlands(乌得勒支大学医学中心影像部,乌得勒支,荷兰) Department of Radiology, Fuzhou University Affiliated Provincial Hospital, Fuzhou, China(福州大学附属省立医院放射科,福州,中国) Department of Radiology, Yantai Yuhuangding Hospital, Shandong, China(烟台毓璜顶医院放射科,山东,中国)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 提出ClinRAG-GRAPH框架,通过构建患者内临床先验图、双分支领域对抗学习和大语言模型驱动的子图检索增强模块,实现术前pCR预测,在内部和外部测试集上取得良好性能。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19911 2026-06-19 cs.AI cs.CL cs.IR 新提交 67%

Multi-Agent Transactive Memory

多智能体交互记忆

To Eun Kim, Xuhong He, Dishank Jain, Ambuj Agrawal, Negar Arabzadeh, Fernando Diaz

机构 * Carnegie Mellon University(卡内基梅隆大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 提出MATM框架,通过共享存储和检索智能体轨迹,实现异构智能体群体间的知识复用,提升下游任务性能并减少交互步骤。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18467 2026-06-18 stat.ML cs.LG 新提交 67%

ToolChain-CRC: Conformal Risk Control for Agentic AI Under Retrieval and Tool-Use Drift

ToolChain-CRC: 检索与工具使用漂移下代理型AI的共形风险控制

Jeffery Opoku, David Banahene

机构 * The University of Texas Rio Grande Valley(德克萨斯大学里奥格兰德谷分校) Florida International University(佛罗里达国际大学)

专题命中 检索器与排序 :RAG(abstract,abstract_cn)

AI总结 针对检索增强和工具使用代理在漂移下的风险控制问题,提出ToolChain-CRC方法,通过构建轨迹级风险评分并校准接受或干预规则,实现可证明的轨迹级风险控制。

Comments 26 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17910 2026-06-17 cs.IR cs.AI cs.CL 新提交 67%

Non-negative Elastic Net Decoding for Information Retrieval

非负弹性网络解码用于信息检索

Koki Okajima, Yasutoshi Ida, Tsukasa Yoshida, Yasuaki Nakamura

机构 * NTT, Inc(NTT公司)

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 提出非负弹性网络(NNN)解码方法,将检索视为联合解码问题,通过稀疏非负线性组合重构查询嵌入,在理论上严格优于稠密检索,实验表明在多个基准上取得一致改进。

Comments 19 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13004 2026-08-14 cs.CL cs.IR 新提交 62%

HybridRAG-BN: A Retrieval-Augmented Framework with Fine-Tuned Verification for Bangla KBQA

HybridRAG-BN:面向孟加拉语知识库问答的带微调验证的检索增强框架

Rathijit Aich, Nirjhar Das, Mahfuzulhoq Chowdhury

专题命中 检索器与排序 :hybrid retrieval(abstract);分类 cs.IR、cs.CL

AI总结 针对孟加拉语KBQA的低资源挑战,提出HybridRAG-BN框架,整合混合检索、答案生成与LoRA微调的验证模块,经实验获竞赛双排行榜第一。

Comments Developed for the IEEE Computer Society CUET Student Branch

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11922 2026-08-13 cs.CL cs.IR cs.LG 新提交 62%

LODESTAR: Trustworthy Entropy Is Navigated, Not Merely Measured -- Reinforced Polarizer Keeps a Frozen LLM from Being Confidently Misled by the Wrong Evidence

LODESTAR:可信赖熵是被引导的,而非仅被测量——强化偏振器防止冻结型大语言模型(LLM)被错误证据误导而自信出错

Po-Jen Ko, Che-Cheng Wu, Hung-Chun Hsu, Li-Yang Chang, Chuan-Ju Wang

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.CL

AI总结 LODESTAR是首个通过强化学习训练偏振器、依据第三方冻结型LLM的不确定性评分文本干预的方法,可提升检索增强问答的F1值等指标,减少模型读取误导性段落的概率。

Comments 28 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07622 2026-08-11 cs.AI cs.IR cs.LG 新提交 62%

Controlled Memory Interference in Continual LLM Agents

持续大型语言模型智能体中的可控记忆干扰

Ao Ding, Hongzong LI, Shiqin Tang, Li Zhang, Liang Chen, Xuyang Chen, Zi Liang

机构 * China University of Geosciences (Beijing)(中国地质大学(北京)) Northwestern Polytechnical University(西北工业大学) The Hong Kong University of Science and Technology(香港科技大学) Chinese Academy of Sciences(中国科学院) The Hong Kong Polytechnic University(香港理工大学) École polytechnique fédérale de Lausanne(洛桑联邦理工学院) National University of Singapore(新加坡国立大学)

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR、cs.AI

AI总结 本研究提出可控记忆干扰(CMI)框架,揭示记忆进化受经验相互作用影响,为持续大型语言模型智能体的记忆系统提供诊断与学习方法,提升记忆更新区分度与任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05151 2026-08-07 cs.CL cs.AI 新提交 62%

Simulator-Grounded Large Language Models for Industrial Causal Reasoning: Tool-Use, Structured Injection, and Plant-Portable Retrieval for Wastewater Treatment Decision Support

面向工业因果推理的模拟器驱动大语言模型:用于污水处理决策支持的工具使用、结构化注入及工厂可迁移检索

Gary Simethy, Daniel Ortiz Arroyo, Petar Durdevic

机构 * Aalborg University(奥尔堡大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.CL、cs.AI

AI总结 该研究对比三种适配Qwen2.5-32B-Instruct模型的方法,在污水处理因果问答任务中,DRR检索器兼具高准确率、跨工厂迁移能力及训练高效性,优于其他方法与基线。

Comments 20 pages, 2 figures, 8 tables. Preprint submitted to Elsevier

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00452 2026-08-04 cs.IR cs.AI 新提交 62%

CeQe: Grounding Lexical Retrieval in Semantic Evidence

CeQe:在语义证据中实现词汇检索

Adam Kahirov, Umesh Deshpande, Swaminathan Sundararaman

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.AI

AI总结 针对BM25的语义词汇鸿沟问题,本文提出CE-QE方法,利用交叉编码器的语义检索结果扩展BM25查询,在多个BEIR数据集上显著提升检索性能且不修改底层索引。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27766 2026-07-31 cs.CL cs.IR cs.LG 新提交 62%

Gradient-free Task-Conditioned Retrieval for On-Device In-Context Learning

面向设备内上下文学习的无梯度任务条件检索

Xinyu Luo, Hui Liu, Yihua Shao, Junyi Yang, Arindam Basu, Haoliang Li

机构 * City University of Hong Kong(香港城市大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR、cs.CL

AI总结 该研究提出无梯度框架CoRA,实现设备内任务条件检索,无需检索器微调等操作,在多数据集及树莓派5部署中展现有效性。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26070 2026-07-30 cs.IR cs.AI 新提交 62%

SimpleWikiSearch: A Clean Offline Wikipedia Environment for Agentic Search

SimpleWikiSearch:用于智能体搜索的简洁离线维基百科环境

Guanming Xiong, Penghui Zhang

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR、cs.AI

AI总结 SimpleWikiSearch是一套明确可运行的离线维基百科环境,用于智能体搜索的可复现评估,提供基线结果及对比闭源模型的子集,而非提出新智能体算法。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20430 2026-07-24 cs.CL cs.AI 新提交 62%

LLM-INSTRUCT at UZH Shared Task 2026: Constraint-Aware Retrieval and Selective Debate for Paragraph-Level Argument Mining

LLM-INSTRUCT在UZH 2026共享任务中的应用:用于段落级论证挖掘的约束感知检索和选择性辩论

Phuong Huu Vu Tran, Long Minh Vo, Son Nguyen Minh Le, Hoang Van

机构 * Vietnamese-German University(越南-德国大学) RMIT University Vietnam(皇家墨尔本理工大学越南分校) VANGIA INNOVATIONS(VANGIA创新公司)

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.CL、cs.AI

AI总结 本文介绍了在UZH 2026共享任务中用于段落级论证挖掘的获胜系统LLM-INSTRUCT,通过元数据感知检索、约束解码等方法缩小决策空间,提高了准确性和提交稳健性,在官方排行榜上取得优异成绩。

Comments Accepted to the 13th Workshop on Argument Mining (ArgMining 2026) at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏