arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 1199 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. RAG评测 1199 篇

2411.14272 2024-11-22 cs.CL 70%

Efficient Aspect-Based Summarization of Climate Change Reports with Small Language Models

Iacopo Ghinassi, Leonardo Catalano, Tommaso Colella

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Journal ref Proceedings of the Third Workshop on NLP for Positive Impact (2024) 123-139

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13226 2024-11-21 cs.CL 70%

AIDBench: A benchmark for evaluating the authorship identification capability of large language models

Zichen Wen, Dadi Guo, Huishuai Zhang

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 21 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08348 2024-11-14 cs.CL 70%

Refining Translations with LLMs: A Constraint-Aware Iterative Prompting Approach

Shangfeng Chen, Xiayang Shi, Pu Li, Yinlin Li, Jingjing Liu

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05349 2024-11-11 cs.AI cs.DC 70%

Enhancing Cluster Resilience: LLM-agent Based Autonomous Intelligent Cluster Diagnosis System and Evaluation Framework

Honghao Shi, Longkai Cheng, Wenli Wu, Yuhang Wang, Xuan Liu, Shaokai Nie, Weixv Wang, Xuebin Min, Chunlei Men, Yonghua Lin

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01428 2024-11-11 cs.CL cs.CV 70%

Superhuman performance in urology board questions by an explainable large language model enabled for context integration of the European Association of Urology guidelines: the UroBot study

Martin J. Hetz, Nicolas Carl, Sarah Haggenmüller, Christoph Wies, Maurice Stephan Michel, Frederik Wessels, Titus J. Brinker

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Journal ref 10.1016/j.esmorw.2024.100078

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02657 2024-11-06 cs.CL 70%

Zebra-Llama: A Context-Aware Large Language Model for Democratizing Rare Disease Knowledge

Karthik Soman, Andrew Langdon, Catalina Villouta, Chinmay Agrawal, Lashaw Salta, Braian Peetoom, Gianmarco Bellucci, Orion J Buske

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 26 pages, 4 figures, 1 supplementary figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00294 2024-11-05 cs.CL 70%

LLM-Ref: Enhancing Reference Handling in Technical Writing with Large Language Models

Kazi Ahmed Asif Fuad, Lizhong Chen

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 20 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01073 2024-11-05 cs.LG cs.AI cs.CR 70%

AttackQA: Development and Adoption of a Dataset for Assisting Cybersecurity Operations using Fine-tuned and Open-Source LLMs

Varun Badrinath Krishna

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18792 2024-10-28 cs.CY cs.CL 70%

An LLM Agent for Automatic Geospatial Data Analysis

Yuxing Chen, Weijie Wang, Sylvain Lobry, Camille Kurtz

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12069 2024-10-17 cs.CL cs.CY cs.HC 70%

De-jargonizing Science for Journalists with GPT-4: A Pilot Study

Sachita Nishal, Eric Lee, Nicholas Diakopoulos

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Accepted to Computation+Journalism Symposium 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06809 2024-10-10 cs.CL 70%

Not All Contexts Are Equal: Teaching LLMs Credibility-aware Generation

Ruotong Pan, Boxi Cao, Hongyu Lin, Xianpei Han, Jia Zheng, Sirui Wang, Xunliang Cai, Le Sun

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Accepted to EMNLP 2024 Main Conference. Our code, benchmark, and models are available at https://github.com/panruotong/CAG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03888 2024-09-25 cs.CL 70%

FaaF: Facts as a Function for the evaluation of generated text

Vasileios Katranidis, Gabor Barany

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02711 2024-09-05 cs.AI 70%

Creating a Gen-AI based Track and Trace Assistant MVP (SuperTracy) for PostNL

Mohammad Reshadati

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.02851 2024-08-23 cs.AI 70%

Natural Language Programming in Medicine: Administering Evidence Based Clinical Workflows with Autonomous Agents Powered by Generative Large Language Models

Akhil Vaid, Joshua Lampert, Juhee Lee, Ashwin Sawant, Donald Apakama, Ankit Sakhuja, Ali Soroush, Sarah Bick, Ethan Abbott, Hernando Gomez, Michael Hadley, Denise Lee, Isotta Landi, Son Q Duong, Nicole Bussola, Ismail Nabeel, Silke Muehlstedt, Silke Muehlstedt, Robert Freeman, Patricia Kovatch, Brendan Carr, Fei Wang, Benjamin Glicksberg, Edgar Argulian, Stamatios Lerakis, Rohan Khera, David L. Reich, Monica Kraft, Alexander Charney, Girish Nadkarni

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments Figures: 5, Tables: 3

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.02811 2024-08-07 cs.AI 70%

Development of REGAI: Rubric Enabled Generative Artificial Intelligence

Zach Johnson, Jeremy Straub

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00804 2024-08-05 cs.AR cs.AI cs.LG 70%

ChipExpert: The Open-Source Integrated-Circuit-Design-Specific Large Language Model

Ning Xu, Zhaoyang Zhang, Lei Qi, Wensuo Wang, Chao Zhang, Zihao Ren, Huaiyuan Zhang, Xin Cheng, Yanqi Zhang, Zhichao Liu, Qingwen Wei, Shiyang Wu, Lanlan Yang, Qianfeng Lu, Yiqun Ma, Mengyao Zhao, Junbo Liu, Yufan Song, Xin Geng, Jun Yang

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21459 2024-08-01 cs.AI 70%

KemenkeuGPT: Leveraging a Large Language Model on Indonesia's Government Financial Data and Regulations to Enhance Decision Making

Gilang Fajar Febrian, Grazziela Figueredo

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments 14 pages, 7 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18333 2024-07-29 cs.AR cs.AI 70%

AutoVCoder: A Systematic Framework for Automated Verilog Code Generation using LLMs

Mingzhe Gao, Jieru Zhao, Zhe Lin, Wenchao Ding, Xiaofeng Hou, Yu Feng, Chao Li, Minyi Guo

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00041 2024-06-28 cs.CL 70%

QUB-Cirdan at "Discharge Me!": Zero shot discharge letter generation by open-source LLM

Rui Guo, Greg Farnan, Niall McLaughlin, Barry Devereux

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments BioNLP 2024 workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12934 2024-06-21 cs.CR cs.AI cs.HC 70%

Current state of LLM Risks and AI Guardrails

Suriya Ganesh Ayyamperumal, Limin Ge

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments Independent study, Exploring LLMs, Deploying LLMs and their Risks

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12806 2024-06-19 cs.SE cs.AI 70%

Identifying Performance-Sensitive Configurations in Software Systems through Code Analysis with LLM Agents

Zehao Wang, Dong Jae Kim, Tse-Hsun Chen

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11034 2024-06-05 cs.CL 70%

PAT-Questions: A Self-Updating Benchmark for Present-Anchored Temporal Question-Answering

Jannat Ara Meem, Muhammad Shihab Rashid, Yue Dong, Vagelis Hristidis

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Accepted to Findings of ACL '24

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20362 2024-06-03 cs.CL cs.CY 70%

Hallucination-Free? Assessing the Reliability of Leading AI Legal Research Tools

Varun Magesh, Faiz Surani, Matthew Dahl, Mirac Suzgun, Christopher D. Manning, Daniel E. Ho

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Our dataset, tool outputs, and labels will be made available upon publication. This version of the manuscript (May 30, 2024) is updated to reflect an evaluation of Westlaw's AI-Assisted Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19563 2024-05-31 cs.CL 70%

Unlearning Climate Misinformation in Large Language Models

Michael Fore, Simranjit Singh, Chaehong Lee, Amritanshu Pandey, Antonios Anastasopoulos, Dimitrios Stamoulis

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00396 2024-05-20 cs.CL 70%

RAGTruth: A Hallucination Corpus for Developing Trustworthy Retrieval-Augmented Language Models

Cheng Niu, Yuanhao Wu, Juno Zhu, Siliang Xu, Kashun Shum, Randy Zhong, Juntong Song, Tong Zhang

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04044 2024-04-11 cs.IR 70%

A Comparison of Methods for Evaluating Generative IR

Negar Arabzadeh, Charles L. A. Clarke

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.IR

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06857 2024-03-12 cs.CL 70%

Development of a Reliable and Accessible Caregiving Language Model (CaLM)

Bambang Parmanto, Bayu Aryoyudanta, Wilbert Soekinto, I Made Agus Setiawan, Yuhan Wang, Haomin Hu, Andi Saptono, Yong K. Choi

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.17415 2024-02-21 cs.CL 70%

Intuitive or Dependent? Investigating LLMs' Behavior Style to Conflicting Prompts

Jiahao Ying, Yixin Cao, Kai Xiong, Yidong He, Long Cui, Yongbin Liu

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06225 2023-10-13 cs.AI cs.LG 70%

GPT-4 as an Agronomist Assistant? Answering Agriculture Exams Using Large Language Models

Bruno Silva, Leonardo Nunes, Roberto Estevão, Vijay Aski, Ranveer Chandra

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13404 2026-08-17 cs.SE cs.CR 版本更新 67%

Does Fixing Break Security? An Empirical Study of Security Degradation in Iterative LLM-Driven Infrastructure-as-Code Repair

修复会破坏安全性吗?对迭代式大语言模型驱动的基础设施即代码修复中安全性退化的实证研究

Benjamin Agyekum, Fabio Santos

专题命中 RAG评测 :RAG(abstract,abstract_cn)

AI总结 该研究通过分析IaC-Eval基准的5968个场景,发现迭代式LLM驱动的IaC修复会引入约3.3%场景的安全退化,主要由资源重构导致,第3次迭代是最优停止点,为安全反馈设计提供指导。

Comments 20 pages, 3 figures, 5 tables. Accepted at the 20th International Symposium on Empirical Software Engineering and Measurement (ESEM 2026). To appear in LIPIcs Vol. 394. v2: corrected the bibliographic record of one reference (preprint, not a journal article) and added the related-version link to the published LIPIcs article

详情

展开后加载摘要…

URL PDF HTML 收藏