arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 1199 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. RAG评测 1199 篇

2507.10577 2025-07-17 cs.CL cs.AI cs.CY 73%

Truth Sleuth and Trend Bender: AI Agents to fact-check YouTube videos and influence opinions

Cécile Logé, Rehan Ghori

机构 * Department of Computer Science Stanford University(计算机科学系 斯坦福大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07983 2025-07-11 cs.CL cs.AI 73%

Performance and Practical Considerations of Large and Small Language Models in Clinical Decision Support in Rheumatology

Sabine Felde, Rüdiger Buchkremer, Gamal Chehab, Christian Thielscher, Jörg HW Distler, Matthias Schneider, Jutta G. Richter

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10955 2025-07-11 cs.CL cs.AI 73%

Investigating Context-Faithfulness in Large Language Models: The Roles of Memory Strength and Evidence Style

Yuepei Li, Kang Zhou, Qiao Qiao, Bach Nguyen, Qing Wang, Qi Li

机构 * Department of Computer Science(计算机科学系) Iowa State University(爱荷华州立大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments This work is published at ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04942 2025-07-09 cs.CL cs.IR 73%

SIGIR 2025 -- LiveRAG Challenge Report

David Carmel, Simone Filice, Guy Horowitz, Yoelle Maarek, Oren Somekh, Ran Tavory, Mehdi Ghissassi, Edo Liberty, Roy Miara

机构 * Technology Innovation Institute (TII)(技术创新研究所) AI71 Pinecone

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.CL

Comments 9 pages, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08324 2025-07-09 cs.CL cs.AI cs.LG 73%

Are LLMs Prescient? A Continuous Evaluation using Daily News as the Oracle

Hui Dai, Ryan Teehan, Mengye Ren

机构 * New York University(纽约大学)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00509 2025-07-02 cs.CL cs.AI 73%

TeamCMU at Touché: Adversarial Co-Evolution for Advertisement Integration and Detection in Conversational Search

To Eun Kim, João Coelho, Gbemileke Onilude, Jai Singh

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23139 2025-07-01 cs.CL cs.AI 73%

Benchmarking Deep Search over Heterogeneous Enterprise Data

Prafulla Kumar Choubey, Xiangyu Peng, Shilpa Bhagavath, Kung-Hsiang Huang, Caiming Xiong, Chien-Sheng Wu

机构 * Salesforce AI Research(Salesforce人工智能研究)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14949 2025-06-30 cs.CV cs.AI cs.CL cs.HC cs.LG 73%

KITAB-Bench: A Comprehensive Multi-Domain Benchmark for Arabic OCR and Document Understanding

Ahmed Heakl, Abdullah Sohail, Mukul Ranjan, Rania Hossam, Ghazi Shazan Ahmad, Mohamed El-Geish, Omar Maher, Zhiqiang Shen, Fahad Khan, Salman Khan

机构 * MBZUAI(马尔瓦大学人工智能研究所) Monta AI(蒙塔人工智能) Linköping University(林雪平大学) Australian National University(澳大利亚国立大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments 17 pages, 5 figures, ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17036 2025-06-25 cs.CL cs.AI 73%

Language Model Re-rankers are Fooled by Lexical Similarities

Lovisa Hagström, Ercong Nie, Ruben Halifa, Helmut Schmid, Richard Johansson, Alexander Junge

机构 * Chalmers University of Technology(楚德大学) University of Gothenburg(哥德堡大学) LMU Munich(慕尼黑大学) Munich Center for Machine Learning(慕尼黑机器学习中心) amass technologies(amass技术公司)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments Accepted to FEVER 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18628 2025-06-24 cs.AI cs.CL 73%

AggTruth: Contextual Hallucination Detection using Aggregated Attention Scores in LLMs

Piotr Matys, Jan Eliasz, Konrad Kiełczyński, Mikołaj Langner, Teddy Ferdinan, Jan Kocoń, Przemysław Kazienko

机构 * Department of Artificial Intelligence, Wroclaw Tech(华沙技术大学人工智能系)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments ICCS 2025 Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13070 2025-06-17 cs.CL cs.AI cs.LG 73%

CHILL at SemEval-2025 Task 2: You Can't Just Throw Entities and Hope -- Make Your LLM to Get Them Right

Jaebok Lee, Yonghyun Ryu, Seongmin Park, Yoonjung Choi

机构 * Samsung Research(三星研究院)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments The 19th International Workshop on Semantic Evaluation

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12483 2025-06-17 cs.AI cs.CL 73%

MALM: A Multi-Information Adapter for Large Language Models to Mitigate Hallucination

Ao Jia, Haiming Wu, Guohui Yao, Dawei Song, Songkun Ji, Yazhou Zhang

机构 * Beijing Institute of Technology(北京理工大学) The Open University(开放大学) Beijing Information Science and Technology University(北京信息科技大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08500 2025-06-17 cs.CL cs.AI cs.LG 73%

DRAGged into Conflicts: Detecting and Addressing Conflicting Sources in Search-Augmented LLMs

Arie Cattan, Alon Jacovi, Ori Ram, Jonathan Herzig, Roee Aharoni, Sasha Goldshtein, Eran Ofek, Idan Szpektor, Avi Caciularu

机构 * Google Research(谷歌研究)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06539 2025-06-10 cs.CL cs.AI 73%

Beyond Facts: Evaluating Intent Hallucination in Large Language Models

Yijie Hao, Haofei Yu, Jiaxuan You

机构 * Emory University(埃默里大学) UIUC(伊利诺伊大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2025 main conference

Journal ref Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (ACL 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02839 2025-06-04 cs.IR cs.AI 73%

DeepShop: A Benchmark for Deep Research Shopping Agents

Yougang Lyu, Xiaoyu Zhang, Lingyong Yan, Maarten de Rijke, Zhaochun Ren, Xiuying Chen

机构 * University of Amsterdam(阿姆斯特丹大学) Shandong University(山东大学) Baidu Inc.(百度公司) Leiden University(莱顿大学) Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07637 2025-05-13 cs.CL cs.AI cs.LG 73%

Chronocept: Instilling a Sense of Time in Machines

Krish Goel, Sanskar Pandey, KS Mahadevan, Harsh Kumar, Vishesh Khadaria

机构 * ProjectEndgame

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments 20 pages, 8 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02171 2025-05-06 cs.CL cs.AI 73%

A New HOPE: Domain-agnostic Automatic Evaluation of Text Chunking

Henrik Brådland, Morten Goodwin, Per-Arne Andersen, Alexander S. Nossum, Aditya Gupta

机构 * Centre for Artificial Intelligence Research, University of Agder(人工智能研究中心,阿格德大学) Norkart AS(Norkart公司)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments 10 pages, To be published in SIGIR25

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00506 2025-05-02 cs.CL cs.AI 73%

HalluMix: A Task-Agnostic, Multi-Domain Benchmark for Real-World Hallucination Detection

Deanna Emery, Michael Goitia, Freddie Vargus, Iulia Neagu

机构 * Quotient AI

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03727 2025-04-28 cs.CL cs.AI cs.LG 73%

FaithEval: Can Your Language Model Stay Faithful to Context, Even If "The Moon is Made of Marshmallows"

Yifei Ming, Senthil Purushwalkam, Shrey Pandit, Zixuan Ke, Xuan-Phi Nguyen, Caiming Xiong, Shafiq Joty

机构 * Salesforce AI Research(Salesforce AI研究院) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments The conference version of this paper is published at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12408 2025-04-18 cs.IR cs.CL 73%

A Human-AI Comparative Analysis of Prompt Sensitivity in LLM-Based Relevance Judgment

Negar Arabzadeh, Charles L. A . Clarke

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00698 2025-04-15 cs.CL cs.AI cs.LG 73%

Command A: An Enterprise-Ready Large Language Model

Team Cohere, :, Aakanksha, Arash Ahmadian, Marwan Ahmed, Jay Alammar, Milad Alizadeh, Yazeed Alnumay, Sophia Althammer, Arkady Arkhangorodsky, Viraat Aryabumi, Dennis Aumiller, Raphaël Avalos, Zahara Aviv, Sammie Bae, Saurabh Baji, Alexandre Barbet, Max Bartolo, Björn Bebensee, Neeral Beladia, Walter Beller-Morales, Alexandre Bérard, Andrew Berneshawi, Anna Bialas, Phil Blunsom, Matt Bobkin, Adi Bongale, Sam Braun, Maxime Brunet, Samuel Cahyawijaya, David Cairuz, Jon Ander Campos, Cassie Cao, Kris Cao, Roman Castagné, Julián Cendrero, Leila Chan Currie, Yash Chandak, Diane Chang, Giannis Chatziveroglou, Hongyu Chen, Claire Cheng, Alexis Chevalier, Justin T. Chiu, Eugene Cho, Eugene Choi, Eujeong Choi, Tim Chung, Volkan Cirik, Ana Cismaru, Pierre Clavier, Henry Conklin, Lucas Crawhall-Stein, Devon Crouse, Andres Felipe Cruz-Salinas, Ben Cyrus, Daniel D'souza, Hugo Dalla-Torre, John Dang, William Darling, Omar Darwiche Domingues, Saurabh Dash, Antoine Debugne, Théo Dehaze, Shaan Desai, Joan Devassy, Rishit Dholakia, Kyle Duffy, Ali Edalati, Ace Eldeib, Abdullah Elkady, Sarah Elsharkawy, Irem Ergün, Beyza Ermis, Marzieh Fadaee, Boyu Fan, Lucas Fayoux, Yannis Flet-Berliac, Nick Frosst, Matthias Gallé, Wojciech Galuba, Utsav Garg, Matthieu Geist, Mohammad Gheshlaghi Azar, Ellen Gilsenan-McMahon, Seraphina Goldfarb-Tarrant, Tomas Goldsack, Aidan Gomez, Victor Machado Gonzaga, Nithya Govindarajan, Manoj Govindassamy, Nathan Grinsztajn, Nikolas Gritsch, Patrick Gu, Shangmin Guo, Kilian Haefeli, Rod Hajjar, Tim Hawes, Jingyi He, Sebastian Hofstätter, Sungjin Hong, Sara Hooker, Tom Hosking, Stephanie Howe, Eric Hu, Renjie Huang, Hemant Jain, Ritika Jain, Nick Jakobi, Madeline Jenkins, JJ Jordan, Dhruti Joshi, Jason Jung, Trushant Kalyanpur, Siddhartha Rao Kamalakara, Julia Kedrzycki, Gokce Keskin, Edward Kim, Joon Kim, Wei-Yin Ko, Tom Kocmi, Michael Kozakov, Wojciech Kryściński, Arnav Kumar Jain, Komal Kumar Teru, Sander Land, Michael Lasby, Olivia Lasche, Justin Lee, Patrick Lewis, Jeffrey Li, Jonathan Li, Hangyu Lin, Acyr Locatelli, Kevin Luong, Raymond Ma, Lukáš Mach, Marina Machado, Joanne Magbitang, Brenda Malacara Lopez, Aryan Mann, Kelly Marchisio, Olivia Markham, Alexandre Matton, Alex McKinney, Dominic McLoughlin, Jozef Mokry, Adrien Morisot, Autumn Moulder, Harry Moynehan, Maximilian Mozes, Vivek Muppalla, Lidiya Murakhovska, Hemangani Nagarajan, Alekhya Nandula, Hisham Nasir, Shauna Nehra, Josh Netto-Rosen, Daniel Ohashi, James Owers-Bardsley, Jason Ozuzu, Dennis Padilla, Gloria Park, Sam Passaglia, Jeremy Pekmez, Laura Penstone, Aleksandra Piktus, Case Ploeg, Andrew Poulton, Youran Qi, Shubha Raghvendra, Miguel Ramos, Ekagra Ranjan, Pierre Richemond, Cécile Robert-Michon, Aurélien Rodriguez, Sudip Roy, Sebastian Ruder, Laura Ruis, Louise Rust, Anubhav Sachan, Alejandro Salamanca, Kailash Karthik Saravanakumar, Isha Satyakam, Alice Schoenauer Sebag, Priyanka Sen, Sholeh Sepehri, Preethi Seshadri, Ye Shen, Tom Sherborne, Sylvie Shang Shi, Sanal Shivaprasad, Vladyslav Shmyhlo, Anirudh Shrinivason, Inna Shteinbuk, Amir Shukayev, Mathieu Simard, Ella Snyder, Ava Spataru, Victoria Spooner, Trisha Starostina, Florian Strub, Yixuan Su, Jimin Sun, Dwarak Talupuru, Eugene Tarassov, Elena Tommasone, Jennifer Tracey, Billy Trend, Evren Tumer, Ahmet Üstün, Bharat Venkitesh, David Venuto, Pat Verga, Maxime Voisin, Alex Wang, Donglu Wang, Shijian Wang, Edmond Wen, Naomi White, Jesse Willman, Marysia Winkels, Chen Xia, Jessica Xie, Minjie Xu, Bowen Yang, Tan Yi-Chern, Ivan Zhang, Zhenyu Zhao, Zhoujie Zhao

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments 55 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01201 2025-04-03 cs.CL cs.AI cs.HC 73%

Medical large language models are easily distracted

Krithik Vishwanath, Anton Alyakin, Daniel Alexander Alber, Jin Vivian Lee, Douglas Kondziolka, Eric Karl Oermann

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments 20 pages, 2 main figures, 6 extended figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07626 2025-03-26 cs.CV cs.AI cs.IR 73%

OmniDocBench: Benchmarking Diverse PDF Document Parsing with Comprehensive Annotations

Linke Ouyang, Yuan Qu, Hongbin Zhou, Jiawei Zhu, Rui Zhang, Qunshu Lin, Bin Wang, Zhiyuan Zhao, Man Jiang, Xiaomeng Zhao, Jin Shi, Fan Wu, Pei Chu, Minghao Liu, Zhenxiang Li, Chao Xu, Bo Zhang, Botian Shi, Zhongying Tu, Conghui He

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.AI

Comments Accepted by CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18174 2025-03-25 cs.CL cs.IR 73%

GINGER: Grounded Information Nugget-Based Generation of Responses

Weronika Łajewska, Krisztian Balog

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15888 2025-03-21 cs.CL cs.AI 73%

Parameters vs. Context: Fine-Grained Control of Knowledge Reliance in Language Models

Baolong Bi, Shenghua Liu, Yiwei Wang, Yilong Xu, Junfeng Fang, Lingrui Mei, Xueqi Cheng

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15620 2025-03-21 cs.CL cs.AI cs.LG 73%

Does Context Matter? ContextualJudgeBench for Evaluating LLM-based Judges in Contextual Settings

Austin Xu, Srijan Bansal, Yifei Ming, Semih Yavuz, Shafiq Joty

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments 23 pages, 13 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14675 2025-03-18 cs.CL cs.AI 73%

To Trust or Not to Trust? Enhancing Large Language Models' Situated Faithfulness to External Contexts

Yukun Huang, Sanxing Chen, Hongyi Cai, Bhuwan Dhingra

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07470 2025-03-11 cs.IR cs.AI cs.LG 73%

Advancing Vietnamese Information Retrieval with Learning Objective and Benchmark

Phu-Vinh Nguyen, Minh-Nam Tran, Long Nguyen, Dien Dinh

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.AI

Journal ref PACLIC38-2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04788 2025-03-10 cs.CL cs.AI cs.LG 73%

AgroLLM: Connecting Farmers and Agricultural Practices through Large Language Models for Enhanced Knowledge Transfer and Practical Application

Dinesh Jackson Samuel, Inna Skarga-Bandurova, David Sikolia, Muhammad Awais

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20730 2025-03-04 cs.AI cs.CL 73%

DeepSolution: Boosting Complex Engineering Solution Design via Tree-based Exploration and Bi-point Thinking

Zhuoqun Li, Haiyang Yu, Xuanang Chen, Hongyu Lin, Yaojie Lu, Fei Huang, Xianpei Han, Yongbin Li, Le Sun

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏