arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 1199 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. RAG评测 1199 篇

2505.04844 2025-05-09 cs.CL 70%

Osiris: A Lightweight Open-Source Hallucination Detection System

Alex Shan, John Bauer, Christopher D. Manning

机构 * Stanford University(斯坦福大学) Stanford HAI(斯坦福HAI)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Stanford 191W

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04784 2025-05-09 cs.CR cs.AI cs.CY 70%

A Proposal for Evaluating the Operational Risk for ChatBots based on Large Language Models

Pedro Pinacho-Davidson, Fernando Gutierrez, Pablo Zapata, Rodolfo Vergara, Pablo Aqueveque

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20368 2025-04-30 cs.MA cs.AI cs.LG 70%

AKIBoards: A Structure-Following Multiagent System for Predicting Acute Kidney Injury

David Gordon, Panayiotis Petousis, Susanne B. Nicholas, Alex A. T. Bui

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments Accepted at International Conference on Autonomous Agents and Multiagent Systems (AAMAS) Workshop, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14429 2025-04-22 cs.CV cs.AI 70%

ResNetVLLM-2: Addressing ResNetVLLM's Multi-Modal Hallucinations

Ahmad Khalil, Mahmoud Khalil, Alioune Ngom

机构 * University of Windsor(温莎大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00824 2025-04-04 cs.CL 70%

ScholarCopilot: Training Large Language Models for Academic Writing with Accurate Citations

Yubo Wang, Xueguang Ma, Ping Nie, Huaye Zeng, Zhiheng Lyu, Yuxuan Zhang, Benjamin Schneider, Yi Lu, Xiang Yue, Wenhu Chen

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05223 2025-03-27 cs.CL 70%

100% Elimination of Hallucinations on RAGTruth for GPT-4 and GPT-3.5 Turbo

Michael C. Wood, Adam A. Forbes

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16922 2025-03-24 cs.SE cs.AI 70%

RustEvo^2: An Evolving Benchmark for API Evolution in LLM-based Rust Code Generation

Linxi Liang, Jing Gong, Mingwei Liu, Chong Wang, Guangsheng Ou, Yanlin Wang, Xin Peng, Zibin Zheng

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12255 2025-03-18 cs.NI cs.AI cs.SI 70%

Agentic Search Engine for Real-Time IoT Data

Abdelrahman Elewah, Khalid Elgazzar

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09902 2025-03-14 cs.IR 70%

Conversational Gold: Evaluating Personalized Conversational Search System using Gold Nuggets

Zahra Abbasiantaeb, Simon Lupart, Leif Azzopardi, Jeffery Dalton, Mohammad Aliannejadi

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.IR

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00686 2025-03-04 cs.SE cs.AI 70%

GPIoT: Tailoring Small Language Models for IoT Program Synthesis and Development

Leming Shen, Qiang Yang, Xinyu Huang, Zijing Ma, Yuanqing Zheng

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20196 2025-02-28 cs.CL 70%

ChineseEcomQA: A Scalable E-commerce Concept Evaluation Benchmark for Large Language Models

Haibin Chen, Kangtao Lv, Chengwei Hu, Yanshi Li, Yujin Yuan, Yancheng He, Xingyao Zhang, Langming Liu, Shilei Liu, Wenbo Su, Bo Zheng

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07238 2025-02-26 cs.CL 70%

OpenThaiGPT 1.5: A Thai-Centric Open Source Large Language Model

Sumeth Yuenyong, Kobkrit Viriyayudhakorn, Apivadee Piyatumrong, Jillaphat Jaroenkantasima

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 8 pages, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10881 2025-02-18 cs.CL 70%

CiteCheck: Towards Accurate Citation Faithfulness Detection

Ziyao Xu, Shaohang Wei, Zhuoheng Han, Jing Jin, Zhe Yang, Xiaoguang Li, Haochen Tan, Zhijiang Guo, Houfeng Wang

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07912 2025-02-13 cs.CL 70%

Elevating Legal LLM Responses: Harnessing Trainable Logical Structures and Semantic Knowledge with Legal Reasoning

Rujing Yao, Yang Wu, Chenghao Wang, Jingwei Xiong, Fang Wang, Xiaozhong Liu

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02009 2025-02-05 cs.SE cs.AI cs.CR cs.LG 70%

LLMSecConfig: An LLM-Based Approach for Fixing Software Container Misconfigurations

Ziyang Ye, Triet Huynh Minh Le, M. Ali Babar

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06595 2025-01-31 cs.CL 70%

GroUSE: A Benchmark to Evaluate Evaluators in Grounded Question Answering

Sacha Muller, António Loison, Bilel Omrani, Gautier Viaud

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Proceedings of the 31st International Conference on Computational Linguistics

Journal ref Proceedings of the 31st International Conference on Computational Linguistics (2025), pages 4510 to 4534, Abu Dhabi, UAE. Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08137 2025-01-31 cs.IR 70%

Generative Information Retrieval Evaluation

Marwah Alaofi, Negar Arabzadeh, Charles L. A. Clarke, Mark Sanderson

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.IR

Comments This chapter is part of the book Information Access in the Era of Generative AI, co-edited by Chirag Shah and Ryen White

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17132 2025-01-29 cs.SE cs.CL 70%

ASTRAL: Automated Safety Testing of Large Language Models

Miriam Ugarte, Pablo Valle, José Antonio Parejo, Sergio Segura, Aitor Arrieta

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Journal ref The 6th ACM/IEEE International Conference on Automation of Software Test (AST 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.11353 2025-01-22 cs.CL 70%

THaMES: An End-to-End Tool for Hallucination Mitigation and Evaluation in Large Language Models

Mengfei Liang, Archish Arun, Zekun Wu, Cristian Munoz, Jonathan Lutch, Emre Kazim, Adriano Koshiyama, Philip Treleaven

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments NeurIPS 2024 SoLaR (Socially Responsible Language Modelling Research ) Workshop

Journal ref NeurIPS Workshop on Socially Responsible Language Modelling Research 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09709 2025-01-17 cs.CY cs.AI 70%

CyberMentor: AI Powered Learning Tool Platform to Address Diverse Student Needs in Cybersecurity Education

Tianyu Wang, Nianjun Zhou, Zhixiong Chen

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07663 2025-01-15 cs.CL 70%

Enhancing Talent Employment Insights Through Feature Extraction with LLM Finetuning

Karishma Thakrar, Nick Young

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04425 2025-01-09 cs.CL 70%

End-to-End Bangla AI for Solving Math Olympiad Problem Benchmark: Leveraging Large Language Model Using Integrated Approach

H. M. Shadman Tabib, Jaber Ahmed Deedar

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Journal ref IJNLC,vol:13, Issue:5/6, page 49-59,2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17146 2024-12-24 cs.AI physics.flu-dyn 70%

LLM Agent for Fire Dynamics Simulations

Leidong Xu, Danyal Mohaddes, Yi Wang

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments NeurIPS 2024 Foundation Models for Science Workshop (38th Conference on Neural Information Processing Systems). 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16176 2024-12-24 cs.SD cs.CL cs.LG eess.AS 70%

Efficient VoIP Communications through LLM-based Real-Time Speech Reconstruction and Call Prioritization for Emergency Services

Danush Venkateshperumal, Rahman Abdul Rafi, Shakil Ahmed, Ashfaq Khokhar

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 15 pages,8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15258 2024-12-23 cs.CL cs.LG 70%

DisEmbed: Transforming Disease Understanding through Embeddings

Salman Faroz

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13582 2024-12-19 cs.CL 70%

EvoWiki: Evaluating LLMs on Evolving Knowledge

Wei Tang, Yixin Cao, Yang Deng, Jiahao Ying, Bo Wang, Yizhe Yang, Yuyue Zhao, Qi Zhang, Xuanjing Huang, Yugang Jiang, Yong Liao

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07724 2024-12-18 cs.CL 70%

Granite Guardian

Inkit Padhi, Manish Nagireddy, Giandomenico Cornacchia, Subhajit Chaudhury, Tejaswini Pedapati, Pierre Dognin, Keerthiram Murugesan, Erik Miehling, Martín Santillán Cooper, Kieran Fraser, Giulio Zizzo, Muhammad Zaid Hameed, Mark Purcell, Michael Desmond, Qian Pan, Zahra Ashktorab, Inge Vejsbjerg, Elizabeth M. Daly, Michael Hind, Werner Geyer, Ambrish Rawat, Kush R. Varshney, Prasanna Sattigeri

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10906 2024-12-17 cs.CL cs.CE cs.LG q-fin.CP 70%

SusGen-GPT: A Data-Centric LLM for Financial NLP and Sustainability Report Generation

Qilong Wu, Xiaoneng Xiang, Hejia Huang, Xuan Wang, Yeo Wei Jie, Ranjan Satapathy, Ricardo Shirota Filho, Bharadwaj Veeravalli

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03258 2024-12-17 cs.CL 70%

GraphInsight: Unlocking Insights in Large Language Models for Graph Structure Understanding

Yukun Cao, Shuo Han, Zengyi Gao, Zezhong Ding, Xike Xie, S. Kevin Zhou

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18947 2024-12-02 cs.LG cs.IR 70%

ICLERB: In-Context Learning Embedding and Reranker Benchmark

Marie Al Ghossein, Emile Contal, Alexandre Robicquet

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR

详情

展开后加载摘要…

URL PDF HTML 收藏