arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 1199 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. RAG评测 1199 篇

2509.02503 2025-09-03 cs.CL cs.LG 70%

L3Cube-IndicHeadline-ID: A Dataset for Headline Identification and Semantic Evaluation in Low-Resource Indian Languages

Nishant Tanksale, Tanmay Kokate, Darshan Gohad, Sarvadnyaa Barate, Raviraj Joshi

机构 * Department of Information Technology, PICT, Pune(信息科技系,PICT,普那) Indian Institute of Technology Madras, Chennai(印度理工学院马德拉斯分校,钦奈) L3Cube Labs, Pune(L3Cube实验室,普那)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20008 2025-09-01 cs.AI cs.PL cs.SE 70%

QHackBench: Benchmarking Large Language Models for Quantum Code Generation Using PennyLane Hackathon Challenges

Abdul Basit, Minghao Shao, Muhammad Haider Asif, Nouhaila Innan, Muhammad Kashif, Alberto Marchisio, Muhammad Shafique

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments To appear at the IEEE International Conference on Quantum Artificial Intelligence (QAI), Naples, Italy, November 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20420 2025-08-29 cs.CL 70%

CAMB: A comprehensive industrial LLM benchmark on civil aviation maintenance

Feng Zhang, Chengjie Pang, Yuehan Zhang, Chenyu Luo

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19365 2025-08-28 cs.IR cs.CY 70%

AI for Statutory Simplification: A Comprehensive State Legal Corpus and Labor Benchmark

Emaan Hariri, Daniel E. Ho

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.IR

Comments 10 pages, 3 figures. To appear in ICAIL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15817 2025-08-25 cs.CL cs.CY 70%

Meet Your New Client: Writing Reports for AI -- Benchmarking Information Loss in Market Research Deliverables

Paul F. Simmering, Benedikt Schulz, Oliver Tabino, Georg Wittenburg

机构 * Agentur für Forschung GmbH(研究机构) Inspirient GmbH(研究机构)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 16 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20616 2025-08-22 cs.AI 70%

PersonaBench: Evaluating AI Models on Understanding Personal Information through Accessing (Synthetic) Private User Data

Juntao Tan, Liangwei Yang, Zuxin Liu, Zhiwei Liu, Rithesh Murthy, Tulika Manoj Awalgaonkar, Jianguo Zhang, Weiran Yao, Ming Zhu, Shirley Kokane, Silvio Savarese, Huan Wang, Caiming Xiong, Shelby Heinecke

机构 * Salesforce AI Research(Salesforce人工智能研究)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments In Findings of the Association for Computational Linguistics: ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11599 2025-08-18 cs.CR cs.AI 70%

CryptoScope: Utilizing Large Language Models for Automated Cryptographic Logic Vulnerability Detection

Zhihao Li, Zimo Ji, Tao Zheng, Hao Ren, Xiao Lan

机构 * Sichuan University(四川大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05970 2025-08-11 cs.SE cs.AI 70%

Impact-driven Context Filtering For Cross-file Code Completion

Yanzhou Li, Shangqing Liu, Kangjie Chen, Tianwei Zhang, Yang Liu

机构 * Nanyang Technological University(南洋理工大学) Nanjing University(南京大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04721 2025-08-08 cs.SD cs.AI eess.AS 70%

Toward Low-Latency End-to-End Voice Agents for Telecommunications Using Streaming ASR, Quantized LLMs, and Real-Time TTS

Vignesh Ethiraj, Ashwath David, Sidhanth Menon, Divya Vijay

机构 * NetoAI

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00602 2025-08-04 cs.CR cs.AI cs.LG 70%

LeakSealer: A Semisupervised Defense for LLMs Against Prompt Injection and Leakage Attacks

Francesco Panebianco, Stefano Bonfanti, Francesco Trovò, Michele Carminati

机构 * Politecnico di Milano(米兰理工学院)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments 22 pages, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20888 2025-07-29 cs.SE cs.CL 70%

Enhancing Project-Specific Code Completion by Inferring Internal API Information

Le Deng, Xiaoxue Ren, Chao Ni, Ming Liang, David Lo, Zhongxin Liu

机构 * State Key Laboratory of Blockchain and Data Security, Zhejiang University(区块链与数据安全国家重点实验室,浙江大学) Ant Group(蚂蚁集团) School of Computing and Information Systems, Singapore Management University(新加坡管理大学计算机与信息系)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07617 2025-07-29 cs.CL 70%

Vuyko Mistral: Adapting LLMs for Low-Resource Dialectal Translation

Roman Kyslyi, Yuliia Maksymiuk, Ihor Pysmennyi

机构 * National Technical University of Ukraine "Igor Sikorsky Kyiv Polytechnic Institute"(乌克兰国家技术大学 "伊戈尔·西科斯基基土夫技术学院") Ukrainian Catholic University(乌克兰天主教大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Preprint. Will be published at Proceedings of the Fourth Ukrainian Natural Language Processing Workshop (UNLP)

Journal ref Proceedings of the Workshop on Ukrainian Natural Language Processing (UNLP), ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08490 2025-07-29 cs.SE cs.AI 70%

Adopting Large Language Models to Automated System Integration

Robin D. Pesl

机构 * University of Stuttgart, Stuttgart, Germany(斯图加特大学)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments This preprint has not undergone peer review (when applicable) or any post-submission improvements or corrections. The Version of Record of this contribution is published in Intelligent Information Systems. CAiSE 2025. Lecture Notes in Business Information Processing, vol 557. Springer, Cham., and is available online at https://doi.org/10.1007/978-3-031-94590-8_37

Journal ref Intelligent Information Systems. CAiSE 2025. Lecture Notes in Business Information Processing, vol 557. Springer, Cham

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14430 2025-07-23 cs.CL 70%

X-Intelligence 3.0: Training and Evaluating Reasoning LLM for Semiconductor Display

Xiaolin Yan, Yangxing Liu, Jiazhang Zheng, Chi Liu, Mingyu Du, Caisheng Chen, Haoyang Liu, Ming Ding, Yuan Li, Qiuping Liao, Linfeng Li, Zhili Mei, Siyu Wan, Li Li, Ruyi Zhong, Jiangling Yu, Xule Liu, Huihui Hu, Jiameng Yue, Ruohui Cheng, Qi Yang, Liangqing Wu, Ke Zhu, Chi Zhang, Chufei Jing, Yifan Zhou, Yan Liang, Dongdong Li, Zhaohui Wang, Bin Zhao, Mingzhou Wu, Mingzhong Zhou, Peng Du, Zuomin Liao, Chao Dai, Pengfei Liang, Xiaoguang Zhu, Yu Zhang, Yu Gu, Kun Pan, Yuan Wu, Yanqing Guan, Shaojing Wu, Zikang Feng, Xianze Ma, Peishan Cheng, Wenjuan Jiang, Jing Ba, Huihao Yu, Zeping Hu, Yuan Xu, Zhiwei Liu, He Wang, Zhenguo Lin, Ming Liu, Yanhong Meng

机构 * TCL Corporate Research(TCL企业研究) TCL China Star Optoelectronic Technology Co Ltd.(TCL中国星光电技术有限公司) National Center of Technology Innovation for Display(显示技术创新国家中心)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11502 2025-07-16 cs.CL cs.CE cs.LG 70%

HKGAI-V1: Towards Regional Sovereign Large Language Model for Hong Kong

Sirui Han, Junqi Zhu, Ruiyuan Zhang, Yike Guo

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12380 2025-07-15 cs.CL 70%

Evaluation of Attribution Bias in Generator-Aware Retrieval-Augmented Large Language Models

Amin Abolghasemi, Leif Azzopardi, Seyyed Hadi Hashemi, Maarten de Rijke, Suzan Verberne

机构 * Leiden University(莱顿大学) University of Strathclyde(斯特拉思克莱德大学) eBay Inc.(eBay公司) University of Amsterdam(阿姆斯特丹大学)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Accepted at ACL 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04854 2025-07-08 cs.CL 70%

$\textit{Grahak-Nyay:}$ Consumer Grievance Redressal through Large Language Models

Shrey Ganatra, Swapnil Bhattacharyya, Harshvivek Kashid, Spandan Anaokar, Shruti Nair, Reshma Sekhar, Siddharth Manohar, Rahul Hemrajani, Pushpak Bhattacharyya

机构 * Indian Institute of Technology Bombay(印度理工学院孟买学院) National Law School of India University(印度国家法律学校大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00352 2025-07-02 cs.SE cs.AI cs.ET 70%

An AST-guided LLM Approach for SVRF Code Synthesis

Abanoub E. Abdelmalak, Mohamed A. Elsayed, David Abercrombie, Ilhami Torunoglu

机构 * Calibre Yield Enhancement Services(Calibre 良率增强服务) Siemens EDA(西门子 EDA) Calibre Research & Development(Calibre 研究与开发) Calibre Product Management(Calibre 产品管理)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments 9 Pages, 5 Figures, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18102 2025-06-24 cs.CL 70%

InspireDebate: Multi-Dimensional Subjective-Objective Evaluation-Guided Reasoning and Optimization for Debating

Fuyu Wang, Jiangtong Li, Kun Zhu, Changjun Jiang

机构 * Key Laboratory of Embedded System and Service Computing, Ministry of Education, Tongji University(嵌入式系统与服务计算重点实验室,教育部,同济大学) School of Computer Science and Technology, Tongji University(计算机科学与技术学院,同济大学)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 20 pages; Accepted to ACL 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17644 2025-06-24 cs.AI 70%

Measuring and Augmenting Large Language Models for Solving Capture-the-Flag Challenges

Zimo Ji, Daoyuan Wu, Wenyuan Jiang, Pingchuan Ma, Zongjie Li, Shuai Wang

机构 * Hong Kong University of Science and Technology(香港科技大学) D-INFK, ETH Zürich(ETH Zürich的D-INFK)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12066 2025-06-17 cs.CL 70%

Focusing on Students, not Machines: Grounded Question Generation and Automated Answer Grading

Gérôme Meyer, Philip Breuer

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07321 2025-06-13 cs.CL 70%

Benchmarking LLMs for Environmental Review and Permitting

Rounak Meyur, Hung Phan, Koby Hayashi, Ian Stewart, Shivam Sharma, Sarthak Chaturvedi, Mike Parker, Dan Nally, Sadie Montgomery, Karl Pazdernik, Ali Jannesari, Mahantesh Halappanavar, Sai Munikoti, Sameera Horawalavithana, Anurag Acharya

机构 * Pacific Northwest National Laboratory(太平洋西北国家实验室) Iowa State University(爱荷华州立大学)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06015 2025-06-09 cs.IR 70%

On the Merits of LLM-Based Corpus Enrichment

Gal Zur, Tommy Mordo, Moshe Tennenholtz, Oren Kurland

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.IR

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23299 2025-05-30 cs.CL 70%

Data-efficient Meta-models for Evaluation of Context-based Questions and Answers in LLMs

Julia Belikova, Konstantin Polev, Rauf Parchiev, Dmitry Simakov

机构 * Sber AI Lab(Sber AI实验室) Moscow Institute of Physics and Technology(莫斯科物理技术学院)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19567 2025-05-27 cs.AI cs.MA 70%

LLM-Agent-Controller: A Universal Multi-Agent Large Language Model System as a Control Engineer

Rasoul Zahedifar, Sayyed Ali Mirghasemi, Mahdieh Soleymani Baghshah, Alireza Taheri

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19284 2025-05-27 cs.IR 70%

RankLLM: A Python Package for Reranking with LLMs

Sahel Sharifymoghaddam, Ronak Pradeep, Andre Slavescu, Ryan Nguyen, Andrew Xu, Zijian Chen, Yilin Zhang, Yidi Chen, Jasper Xian, Jimmy Lin

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR

Comments SIGIR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20006 2025-05-27 cs.IR 70%

Chatbot Arena Meets Nuggets: Towards Explanations and Diagnostics in the Evaluation of LLM Responses

Sahel Sharifymoghaddam, Shivani Upadhyay, Nandan Thakur, Ronak Pradeep, Jimmy Lin

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR

Comments 10 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16102 2025-05-27 cs.CL 70%

Continually Self-Improving Language Models for Bariatric Surgery Question--Answering

Yash Kumar Atri, Thomas H Shin, Thomas Hartvigsen

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Data and Code available at https://github.com/yashkumaratri/bRAGgen

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11651 2025-05-22 cs.IR cs.CV 70%

MIRACL-VISION: A Large, multilingual, visual document retrieval benchmark

Radek Osmulski, Gabriel de Souza P. Moreira, Ronay Ak, Mengyao Xu, Benedikt Schifferer, Even Oldridge

机构 * The Thørväld Group(Thørväld集团) Inria Paris-Rocquencourt(巴黎-罗克琴库尔Inria) Rajiv Gandhi University Doimukh(拉朱·甘地大学多伊穆克) Tsinghua University(清华大学) Palmer Research Laboratories(Palmer研究实验室) The Kumquat Consortium(Kumquat联盟)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07528 2025-05-13 cs.CL 70%

SEReDeEP: Hallucination Detection in Retrieval-Augmented Models via Semantic Entropy and Context-Parameter Fusion

Lei Wang

机构 * Hunan University(湖南大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏