arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 8572 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 4558 篇

2512.14879 2025-12-18 cs.LG cs.AI 57%

Entropy-Reservoir Bregman Projection: An Information-Geometric Unification of Model Collapse

熵-蓄水池Bregman投影:信息几何统一模型崩溃

Jingwei Chen

机构 * Independent Researcher(独立研究者)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 ERBP通过信息几何框架统一模型崩溃现象,提供熵流监控和预算的设计规则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13237 2025-12-16 cs.LG cs.IR 57%

Learning to Retrieve with Weakened Labels: Robust Training under Label Noise

通过弱化标签学习进行检索:在标签噪声下鲁棒训练

Arnab Sharma

机构 * Heinz Nixdorf Institute(海因茨·尼克斯多夫研究所) Paderborn University(帕德博恩大学)

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.IR

AI总结 本文提出通过弱化标签的方法来提高在存在标签噪声下的检索模型鲁棒性,通过允许多个可能的标签来改进检索任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11997 2025-12-16 cs.AI 57%

Log Anomaly Detection with Large Language Models via Knowledge-Enriched Fusion

通过知识增强融合进行大规模语言模型的日志异常检测

Anfeng Peng, Ajesh Koyatan Chathoth, Stephen Lee

机构 * University of Pittsburgh(匹兹堡大学) Eaton Corporation(埃顿公司)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 EnrichLog通过知识增强融合技术,提升日志异常检测的准确性和可解释性,适用于实际系统部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02925 2025-12-15 cs.LG cs.CL q-bio.BM 57%

Large Language Model Agent for Modular Task Execution in Drug Discovery

用于药物发现模块化任务执行的大型语言模型代理

Janghoon Ock, Radheesh Sharma Meda, Srivathsan Badrinarayanan, Neha S. Aluru, Achuth Chandrasekhar, Amir Barati Farimani

机构 * Department of Chemical Engineering, Carnegie Mellon University(化学工程系,卡内基梅隆大学) Department of Material Science and Engineering, Carnegie Mellon University(材料科学与工程系,卡内基梅隆大学) Department of Mechanical Engineering, Carnegie Mellon University(机械工程系,卡内基梅隆大学)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文提出了一种基于大型语言模型的模块化框架,用于药物发现中的任务执行,通过自动化分子生成和属性预测提升药物筛选效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09440 2025-12-11 cs.CL 57%

Knowledge-Augmented Large Language Model Agents for Explainable Financial Decision-Making

基于知识增强的大语言模型代理的可解释金融决策方法

Qingyuan Zhang, Yuxi Wang, Cancan Hua, Yulin Huang, Ning Lyu

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.CL

AI总结 本文提出基于知识增强的大语言模型代理,通过整合外部知识检索、语义表示和推理生成,提升金融决策的可解释性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08617 2025-12-10 cs.CL 57%

HealthcareNLP: where are we and what is next?

HealthcareNLP: 我们在哪里以及下一步是什么?

Lifeng Han, Paul Rayson, Suzan Verberne, Andrew Moore, Goran Nenadic

机构 * Leiden University Medical Centre(莱顿大学医学中心) Lancaster University(兰卡斯特大学) University of Manchester(曼彻斯特大学) The Leiden Institute of Advanced Computer Science(莱顿先进计算机科学研究所)

专题命中 检索器与排序 :retrieval augmented generation(abstract);分类 cs.CL

AI总结 本文提出一个关于HealthcareNLP的入门教程,涵盖医疗领域NLP的应用现状、挑战及未来方向,包含数据资源、NLP评估和患者层面的多层次内容。

Comments Accepted Tutorial by LREC 2026 https://lrec2026.info/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04416 2025-12-09 cs.AI cs.SE 57%

DataGovBench: Benchmarking LLM Agents for Real-World Data Governance Workflows

DataGovBench: 为现实世界数据治理工作流程评估LLM代理

Zhou Liu, Zhaoyang Han, Guochen Yan, Hao Liang, Bohan Zeng, Xing Chen, Yuanfeng Song, Wentao Zhang

机构 * Peking University(北京大学) ByteDance(字节跳动)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

AI总结 DataGovBench通过150种现实任务评估LLM代理在数据治理中的表现,提出DataGovAgent框架提升复杂任务性能和调试效率。

Comments Equal contribution: Zhou Liu and Zhaoyang Han. Corresponding authors: Yuanfeng Song and Wentao Zhang

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01523 2025-12-05 cs.IR 57%

MetaSynth: Multi-Agent Metadata Generation from Implicit Feedback in Black-Box Systems

MetaSynth: 从黑盒系统中的隐式反馈生成多智能体元数据

Shreeranjani Srirangamsridharan, Ali Abavisani, Reza Yousefi Maragheh, Ramin Giahi, Kai Zhao, Jason Cho, Sushant Kumar

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.IR

AI总结 MetaSynth通过多智能体检索增强生成框架,利用黑盒系统中的隐式反馈优化元数据生成,提升了CTR和点击率表现。

Comments IEEE Big Data 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00882 2025-12-04 cs.CV cs.AI 57%

Look, Recite, Then Answer: Enhancing VLM Performance via Self-Generated Knowledge Hints

看、复述、然后回答:通过自动生成的知识提示提升VLM性能

Xisheng Feng

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI

AI总结 通过自动生成的知识提示提升VLM性能,采用模块化设计减少幻觉,实现精准农业中杂草识别准确率的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10695 2025-12-02 cs.CL 57%

"As Eastern Powers, I will veto." : An Investigation of Nation-level Bias of Large Language Models in International Relations

作为东方国家,我将 veto。:对大型语言模型在国际关系领域国家层面偏见的调查

Jonghyeon Choi, Yeonjun Choi, Hyun-chul Kim, Beakcheol Jang

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文研究了大型语言模型在国际关系领域中的国家层面偏见,提出了一种去偏框架以减少偏见并提升性能。

Comments 21 pages, 4 figures. This is the extended version of the paper accepted at AAAI 2026, which includes all technical appendices and additional experimental details

Journal ref AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05613 2025-12-01 cs.AI 57%

Domain adaptation of large language models for geotechnical applications

大语言模型在地质应用中的领域适应

Lei Fan, Fangxue Liu, Cheng Chen

专题命中 检索器与排序 :retrieval augmented generation(abstract);分类 cs.AI

AI总结 本文系统回顾了大语言模型在地质应用中的领域适应方法,分析了四种关键策略并评估其优劣,指出领域适应LLMs在提升推理准确性方面的作用,同时揭示数据稀缺和可解释性挑战等限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09019 2025-12-01 cs.CL 57%

MedMobile: A mobile-sized language model with clinical capabilities

MedMobile: 一种具有临床能力的移动尺寸语言模型

Krithik Vishwanath, Jaden Stryker, Anton Alyakin, Daniel Alexander Alber, Eric Karl Oermann

专题命中 检索器与排序 :retrieval augmented generation(abstract);分类 cs.CL

AI总结 MedMobile是一种移动尺寸的语言模型,通过高效的方法在医疗领域实现高性能表现,成为参数最少且性能最佳的临床应用模型。

Comments 24 pages, 7 figures (4 main, 3 supplementary)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21721 2025-12-01 cs.CL cs.CY cs.LG 57%

PeerCoPilot: A Language Model-Powered Assistant for Behavioral Health Organizations

PeerCoPilot: 一种基于语言模型的助手法师,用于行为健康组织

Gao Mo, Naveen Raman, Megan Chai, Cindy Peng, Shannon Pagdon, Nev Jones, Hong Shen, Peggy Swarbrick, Fei Fang

机构 * Behavioral Health Organizations(心理健康组织)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 PeerCoPilot是一种基于语言模型的助手,帮助行为健康组织的同伴提供者制定健康计划和目标,提高服务质量和效率。

Comments Accepted at IAAI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13410 2025-11-27 cs.CL 57%

Mem-PAL: Towards Memory-based Personalized Dialogue Assistants for Long-term User-Agent Interaction

Mem-PAL: 向基于记忆的个性化对话助手迈进:长期用户-代理交互

Zhaopei Huang, Qifeng Dai, Guozheng Wu, Xiaopeng Wu, Kehan Chen, Chuan Yu, Xubin Li, Tiezheng Ge, Wenxuan Wang, Qin Jin

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL

AI总结 Mem-PAL提出H$^2$Memory框架,通过合成数据和实验验证,提升长期用户-代理交互的个性化能力。

Comments Accepted by AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03263 2025-11-26 cs.LG cs.AI 57%

Memory Self-Regeneration: Uncovering Hidden Knowledge in Unlearned Models

记忆自我再生:在未学习模型中揭示隐藏知识

Agnieszka Polowczyk, Alicja Polowczyk, Joanna Waczyńska, Piotr Borycki, Przemysław Spurek

机构 * Silesian University of Technology(谢勒斯大学技术学院) Jagiellonian University(雅盖隆大学) IDEAS Research Institute(IDEAS研究所)

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI

AI总结 本文提出记忆自我再生任务和MemoRa策略,旨在解决模型遗忘难题,通过增强知识检索的鲁棒性提升反学习效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16566 2025-11-21 cs.CV cs.AI 57%

NutriScreener: Retrieval-Augmented Multi-Pose Graph Attention Network for Malnourishment Screening

NutriScreener: 一种结合检索增强的多姿态图注意力网络用于营养不良筛查

Misaal Khan, Mayank Vatsa, Kuldeep Singh, Richa Singh

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.AI

AI总结 NutriScreener通过结合检索增强的多姿态图注意力网络,实现儿童营养不良的高效检测与体格测量预测,适用于低资源环境。

Comments Accepted in AAAI 2026 Special Track on AI for Social Impact

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14758 2025-11-19 cs.IR 57%

NeuCLIRBench: A Modern Evaluation Collection for Monolingual, Cross-Language, and Multilingual Information Retrieval

Dawn Lawrie, James Mayfield, Eugene Yang, Andrew Yates, Sean MacAvaney, Ronak Pradeep, Scott Miller, Paul McNamee, Luca Soldani

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

Comments 14 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18966 2025-11-18 cs.CL 57%

DataGen: Unified Synthetic Dataset Generation via Large Language Models

Yue Huang, Siyuan Wu, Chujie Gao, Dongping Chen, Qihui Zhang, Yao Wan, Tianyi Zhou, Jianfeng Gao, Chaowei Xiao, Lichao Sun, Xiangliang Zhang

机构 * University of Notre Dame(诺丁汉大学) Huazhong University of Science and Technology(华中科技大学) MBZUAI University of Washington(华盛顿大学) Peking University(北京大学) University of Maryland, College Park(马里兰大学学院市分校) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) Microsoft Research(微软研究院) Lehigh University(莱斯大学)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10879 2025-11-17 cs.CL cs.LG 57%

ICX360: In-Context eXplainability 360 Toolkit

Dennis Wei, Ronny Luss, Xiaomeng Hu, Lucas Monteiro Paes, Pin-Yu Chen, Karthikeyan Natesan Ramamurthy, Erik Miehling, Inge Vejsbjerg, Hendrik Strobelt

机构 * IBM Research(IBM研究院)

专题命中 检索器与排序 :retrieval augmented generation(abstract);分类 cs.CL

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07682 2025-11-12 cs.HC cs.AI 57%

Designing and Evaluating Malinowski's Lens: An AI-Native Educational Game for Ethnographic Learning

Michael Hoffmann, Jophin John, Jan Fillies, Adrian Paschke

机构 * Leibniz Supercomputing Centre(莱比锡超算中心) Stanford University(斯坦福大学)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

Comments 21 pages, 8 figures. Full preprint version; shorter version in preparation

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19405 2025-11-11 cs.AI 57%

Logic Distillation: Learning from Code Function by Function for Decision-making Tasks

Dong Chen, Shilin Zhang, Fei Gao, Yueting Zhuang, Siliang Tang, Qidong Liu, Mingliang Xu

机构 * The School of Computer and Artificial Intelligence of Zhengzhou University(郑州大学计算机与人工智能学院) Engineering Research Center of Intelligent Swarm Systems, Ministry of Education(教育部智能群体系统工程研究中心) National Supercomputing Center In Zhengzhou(郑州国家超级计算中心) Zhejiang University(浙江大学)

专题命中 检索器与排序 :retriever(abstract);分类 cs.AI

Comments 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11177 2025-11-11 cs.CL 57%

Retrieval-Augmented Feature Generation for Domain-Specific Classification

Xinhao Zhang, Jinghan Zhang, Fengran Mo, Dakshak Keerthi Chandra, Yu-Zhong Chen, Fei Xie, Kunpeng Liu

专题命中 检索器与排序 :knowledge retrieval(abstract);分类 cs.CL

Comments Accepted by ICDM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04643 2025-11-10 cs.CL 57%

When retrieval outperforms generation: Dense evidence retrieval for scalable fake news detection

Alamgir Munir Qazi, John P. McCrae, Jamal Abdul Nasir

机构 * School of Computer Science, University of Galway, Ireland(Galway大学计算机科学学院) Research Ireland Insight Centre and ADAPT Centre, University of Galway, Ireland(Galway大学爱尔兰研究洞察中心和ADAPT研究中心)

专题命中 检索器与排序 :dense retrieval(abstract);分类 cs.CL

Journal ref Proceedings of the 5th Conference on Language, Data and Knowledge, pages 255-265, Naples, Italy. Unior Press, September 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04234 2025-11-07 cs.CL 57%

Reusing Pre-Training Data at Test Time is a Compute Multiplier

Alex Fang, Thomas Voice, Ruoming Pang, Ludwig Schmidt, Tom Gunter

机构 * Apple(苹果公司) Stanford(斯坦福大学)

专题命中 检索器与排序 :retrieval augmented generation(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04205 2025-11-07 cs.CL 57%

LLM-as-a-Judge is Bad, Based on AI Attempting the Exam Qualifying for the Member of the Polish National Board of Appeal

Michał Karp, Anna Kubaszewska, Magdalena Król, Robert Król, Aleksander Smywiński-Pohl, Mateusz Szymański, Witold Wydmański

机构 * Polish National Board of Appeal(波兰国家上诉委员会)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01581 2025-11-04 cs.AI 57%

ExplicitLM: Decoupling Knowledge from Parameters via Explicit Memory Banks

Chengzhang Yu, Zening Lu, Chenyang Zheng, Chiyue Wang, Yiming Zhang, Zhanpeng Jin

机构 * South China University of Technology(南方科技大学) University of Science and Technology of China(中国科学技术大学) Hefei Institutes of Physical Science(合肥物理科学研究院)

专题命中 检索器与排序 :RAG(abstract);分类 cs.AI

Comments 12pages, 4figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00903 2025-11-04 cs.CL 57%

ColMate: Contrastive Late Interaction and Masked Text for Multimodal Document Retrieval

Ahmed Masry, Megh Thakkar, Patrice Bechard, Sathwik Tejaswi Madhusudhan, Rabiul Awal, Shambhavi Mishra, Akshay Kalkunte Suresh, Srivatsava Daruru, Enamul Hoque, Spandana Gella, Torsten Scholak, Sai Rajeswar

机构 * ServiceNow York University(约克大学) MILA - Quebec AI Institute(魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) École de technologie supérieure(卓越工程学院)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00805 2025-11-04 cs.IR 57%

REaR: Retrieve, Expand and Refine for Effective Multitable Retrieval

Rishita Agarwal, Himanshu Singhal, Peter Baile Chen, Manan Roy Choudhury, Dan Roth, Vivek Gupta

专题命中 检索器与排序 :retriever(abstract);分类 cs.IR

Comments 13 pages, 2 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12872 2025-11-04 cs.MA cs.AI stat.ML 57%

KVCOMM: Online Cross-context KV-cache Communication for Efficient LLM-based Multi-agent Systems

Hancheng Ye, Zhengqi Gao, Mingyuan Ma, Qinsi Wang, Yuzhe Fu, Ming-Yu Chung, Yueqian Lin, Zhijian Liu, Jianyi Zhang, Danyang Zhuo, Yiran Chen

机构 * Duke University(杜克大学) MIT(麻省理工学院) NVIDIA(英伟达)

专题命中 检索器与排序 :retrieval-augmented generation(abstract);分类 cs.AI

Comments Accepted for publication in NeurIPS2025. Code is available at \url{https://github.com/FastMAS/KVCOMM}

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20434 2025-10-28 cs.SE cs.AI 57%

ARCS: Agentic Retrieval-Augmented Code Synthesis with Iterative Refinement

Manish Bhattarai, Miguel Cordova, Minh Vu, Javier Santos, Ismael Boureima, Dan O'Malley

机构 * Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室)

专题命中 检索器与排序 :RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏