arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 1199 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. RAG评测 1199 篇

2604.11419 2026-04-14 cs.AI cs.CR 83%

Beyond RAG for Cyber Threat Intelligence: A Systematic Evaluation of Graph-Based and Agentic Retrieval

超越RAG的网络威胁情报:基于图和代理检索的系统评估

Dzenan Hamzic, Florian Skopik, Max Landauer, Markus Wurzenberger, Andreas Rauber

机构 * AIT Austrian Institute of Technology(AIT奥地利技术研究所)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.AI

AI总结 本文系统评估了四种RAG架构在CTI分析中的表现,发现图检索在结构化查询中表现更优,混合图文方法在多跳查询中提升答案质量达35%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10745 2026-04-14 cs.CL 83%

How You Ask Matters! Adaptive RAG Robustness to Query Variations

提问方式影响重大!适应性RAG对查询变化的鲁棒性

Yunah Jang, Megha Sundriyal, Kyomin Jung, Meeyoung Cha

机构 * Seoul National University(首尔大学) Max Planck Institute for Security and Privacy(马克斯·普朗克安全与隐私研究所)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 研究探讨了适应性RAG在面对不同表层查询形式时的鲁棒性,通过大规模基准测试发现小幅度语义变化会显著影响检索行为和准确性,揭示了适应性RAG在保持语义一致时的鲁棒性挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10734 2026-04-14 cs.CL 83%

Self-Correcting RAG: Enhancing Faithfulness via MMKP Context Selection and NLI-Guided MCTS

自校正RAG:通过MMKP上下文选择和NLI引导的MCTS增强忠实性

Shijia Xu, Zhou Wu, Xiaolong Jia, Yu Wang, Kai Liu, April Xiaowen Dong

机构 * Chongqing University(重庆大学) Queen Mary University of London(伦敦玛丽女王大学) Chongqing Key Laboratory of Big Data Intelligence and Privacy Computing(重庆市大数据智能与隐私计算重点实验室) Fangda Partners(方达律师事务所)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本研究提出Self-Correcting RAG框架,通过MMKP上下文选择和NLI引导的MCTS机制,提升复杂推理任务中的准确性和减少幻觉。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03926 2026-04-09 cs.AI cs.CY cs.HC cs.MA 83%

CODE-GEN: A Human-in-the-Loop RAG-Based Agentic AI System for Multiple-Choice Question Generation

CODE-GEN:一种基于检索增强生成的多选题生成人机协作人工智能系统

Xiaojing Duan, Frederick Nwanganga, Chaoli Wang

机构 * University of Notre Dame(圣母大学)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.AI

AI总结 CODE-GEN通过生成与课程目标一致的多选题提升学生代码推理能力,采用生成器和验证器代理,结合专用工具提高准确性,评估结果显示系统在七个教学维度上表现优异,但人类专家仍需参与设计教学性干扰项和反馈质量。

Comments Full version of the paper accepted as a short paper at the 27th International Conference on Artificial Intelligence in Education (AIED 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27253 2026-04-09 cs.CL 83%

Mitigating Hallucination on Hallucination in RAG via Ensemble Voting

通过集成投票缓解RAG中的幻觉

Zequn Xie, Zhengyang Sun

机构 * Polytechnic Institute Zhejiang University Hangzhou, China School of Computer Science Technology Xinjiang University Urumqi, China

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文提出VOTE-RAG框架,通过集成投票机制缓解RAG中的幻觉问题,实验表明其性能优于复杂框架,且结构简单、并行高效。

Comments arXiv admin note: text overlap with arXiv:2505.18581 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05358 2026-04-08 cs.AI cs.LG 83%

LatentAudit: Real-Time White-Box Faithfulness Monitoring for Retrieval-Augmented Generation with Verifiable Deployment

LatentAudit: 用于检索增强生成的实时白盒可信度监控与可验证部署

Zhe Yu, Wenpeng Xing, Meng Han

机构 * Binjiang Institute of Zhejiang University(浙江大学滨江研究院) Communication University of Zhejiang(浙江传媒学院) Zhejiang University(浙江大学)

专题命中 RAG评测 :retrieval-augmented generation(title,abstract);RAG(abstract);分类 cs.AI

AI总结 LatentAudit通过分析生成器中间层激活来实时监控RAG系统的可信度,无需额外模型,且在多个基准测试中表现出高准确率和低延迟,支持公开验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00296 2026-04-07 cs.IR 83%

RAGRouter-Bench: A Dataset and Benchmark for Adaptive RAG Routing

RAGRouter-Bench:一种自适应RAG路由的数据库和基准测试

Ziqi Wang, Xi Zhu, Shuhang Lin, Haochen Xue, Minghao Guo, Yongfeng Zhang

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.IR

AI总结 本文提出RAGRouter-Bench,首个用于自适应RAG路由的数据库和基准测试,通过整合查询-语料兼容性、细粒度语料指标和统一评估协议,系统评估生成质量和资源消耗,验证自适应路由在不同查询-语料上下文中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02640 2026-04-06 cs.CL 83%

Overcoming the "Impracticality" of RAG: Proposing a Real-World Benchmark and Multi-Dimensional Diagnostic Framework

克服RAG的“不实际性”:提出一个现实世界基准和多维诊断框架

Kenichirou Narita, Siqi Peng, Taku Fukui, Moyuru Yamada, Satoshi Munakata, Satoru Takahashi

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文提出一个现实世界RAG基准和多维诊断框架,以解决企业环境中RAG系统评估的复杂挑战,提升系统可靠性。

Comments 8 pages, 3 figures. Accepted at AAAI 2026 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05866 2026-03-31 cs.CL 83%

FACTUM: Mechanistic Detection of Citation Hallucination in Long-Form RAG

FACTUM:长形式RAG中引用幻觉的机制检测

Maxime Dassen, Rebecca Kotula, Kenton Murray, Andrew Yates, Dawn Lawrie, Efsun Kayi, James Mayfield, Kevin Duh

机构 * University of Amsterdam(阿姆斯特丹大学) Department of Defense(美国国防部) HLTCOE, Johns Hopkins University(约翰霍普金斯大学HLTCOE) Applied Physics Laboratory, Johns Hopkins University(约翰霍普金斯大学应用物理实验室)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 FACTUM通过四个机制性评分(CAS、BAS、PFS、PAS)检测RAG中的引用幻觉,发现高参数力(PFS)和注意力sink使用(BAS)与正确引用相关,且随着模型规模变化,正确性特征也随之演变,FACTUM在AUC上优于现有方法37.5%。

Comments Accepted at ECIR 2026. 13 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00216 2026-03-27 cs.CL 83%

From Evidence-Based Medicine to Knowledge Graph: Retrieval-Augmented Generation for Sports Rehabilitation and a Domain Benchmark

从循证医学到知识图谱:面向体育康复的检索增强生成及领域基准

Jinning Zhang, Jie Song, Wenhui Tu, Zecheng Li, Jingxuan Li, Jin Li, Xuan Liu, Taole Sha, Zichen Wei, Yan Li

机构 * Beijing Key Laboratory of Sports Performance and Skill Assessment, Beijing Sport University(北京体育大学北京市运动表现与技能评估重点实验室) Department of Exercise Physiology, School of Sport Science, Beijing Sport University(北京体育大学运动科学学院运动生理学教研室) School of Sport Medicine and Physical Therapy, Beijing Sport University(北京体育大学运动医学与康复学院) Rehabilitation Center, Beijing Rehabilitation Hospital(北京康复医院康复中心) Optum Care Washington School of Management, Beijing Sport University(北京体育大学管理学院) Department of Statistics and Actuarial Science, The University of Hong Kong(香港大学统计与精算学系)

专题命中 RAG评测 :retrieval-augmented generation(title,abstract);RAG(abstract);分类 cs.CL

AI总结 本文提出SR-RAG框架,结合PICO框架构建知识图谱并改进检索,引入贝叶斯证据层级重排序方法,通过体育康复验证,释放包含357844个节点和371226条边的知识图谱及1637个问答对基准,显著优于基线模型。

Comments 18 pages, 3 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20534 2026-03-25 cs.SE cs.AI 83%

An Industrial-Scale Retrieval-Augmented Generation Framework for Requirements Engineering: Empirical Evaluation with Automotive Manufacturing Data

面向工业规模的检索增强生成框架用于需求工程:基于汽车制造数据的实证评估

Muhammad Khalid, Yilmaz Uygun

专题命中 RAG评测 :retrieval-augmented generation(title,abstract);RAG(abstract);分类 cs.AI

AI总结 本文提出一个工业级检索增强生成框架,用于需求工程自动化,通过实证评估展示其在提高提取准确性和减少人工分析时间方面的优势。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11650 2026-03-13 cs.CL 83%

QChunker: Learning Question-Aware Text Chunking for Domain RAG via Multi-Agent Debate

QChunker: 通过多智能体辩论学习问题感知的文本分块以实现领域RAG

Jihao Zhao, Daixuan Li, Pengfei Li, Shuaishuai Zu, Biao Qin, Hongyan Liu

机构 * School of Information, Renmin University of China(中国人民大学信息学院) School of Smart Governance, Renmin University of China(中国人民大学智能治理学院) School of Information, BRAIN, Renmin University of China(中国人民大学信息学院、BRAIN学院) School of Economics and Management, Tsinghua University(清华大学经济管理学院)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 QChunker通过多智能体辩论框架,提升RAG中文本分块的语义完整性和信息粒度,采用ChunkScore评估指标,实现更高效高质量的文本分块生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09704 2026-03-12 cs.CL 83%

Evaluation of LLMs in retrieving food and nutritional context for RAG systems

对LLMs在RAG系统中检索食物和营养上下文的评估

Maks Požarnik Vavken, Matevž Ogrinc, Tome Eftimov, Barbara Koroušić Seljak

机构 * Department of Computer Systems Institute "Jožef Stefan"(计算机系统研究所(Jožef Stefan)部门)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文评估了LLMs在RAG系统中检索食物和营养信息的能力,发现其在可表达约束下表现良好,但在复杂约束下存在局限。

Comments This is the preprint for our conference paper for IEEE International Conference on Big Data

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04238 2026-03-05 cs.CL 83%

Retrieval or Representation? Reassessing Benchmark Gaps in Multilingual and Visually Rich RAG

检索还是表示?重新评估多语言和视觉丰富的RAG基准差距

Martin Asenov, Kenza Benkirane, Dan Goldwater, Aneiss Ghodsi

机构 * Parexel AI Labs(Parexel AI实验室)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 该研究通过系统分析发现,文档表示质量是多语言和视觉丰富RAG基准提升的主要因素,而非检索方法改进。

Comments ICLR 2026 Workshop I Can't Believe It's Not Better: Where Large Language Models Need to Improve

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11371 2026-03-05 cs.IR 83%

RAG vs. GraphRAG: A Systematic Evaluation and Key Insights

RAG与GraphRAG:系统评估与关键洞察

Haoyu Han, Li Ma, Yu Wang, Harry Shomer, Yongjia Lei, Zhisheng Qi, Kai Guo, Zhigang Hua, Bo Long, Hui Liu, Charu C. Aggarwal, Jiliang Tang

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.IR

AI总结 本文系统评估RAG与GraphRAG在文本任务中的表现,提出统一评估协议,揭示两者优势与权衡,并探索整合策略以提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03300 2026-03-05 cs.CL 83%

Benchmarking Legal RAG: The Promise and Limits of AI Statutory Surveys

法律RAG基准测试:AI立法调研的潜力与局限

Mohamed Afane, Emaan Hariri, Derek Ouyang, Daniel E. Ho

机构 * Stanford University(斯坦福大学)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文评估了三种新兴工具在法律RAG基准测试中的表现,发现STARA性能显著提升,而商业平台表现不佳,同时揭示了DOL律师的遗漏问题,并提出了法律RAG的未来设计原则。

Comments Accepted at the 5th ACM Symposium on Computer Science and Law (CS&Law '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23184 2026-02-27 cs.CL 83%

MTRAG-UN: A Benchmark for Open Challenges in Multi-Turn RAG Conversations

MTRAG-UN:多轮检索增强生成对话中开放挑战的基准

Sara Rosenthal, Yannis Katsis, Vraj Shah, Lihong He, Lucian Popa, Marina Danilevsky

机构 * IBM Research(IBM研究院)

专题命中 RAG评测 :RAG(title,abstract);retrieval augmented generation(abstract);分类 cs.CL

AI总结 MTRAG-UN是一个用于评估多轮检索增强生成对话中开放挑战的基准,包含666个任务和2800多轮对话,揭示了检索和生成模型在处理无答案、无描述等问题时的不足。

Comments 5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15859 2026-02-19 cs.CL 83%

From Transcripts to AI Agents: Knowledge Extraction, RAG Integration, and Robust Evaluation of Conversational AI Assistants

从语音记录到AI代理:知识提取、RAG整合及对话式AI助手的鲁棒评估

Krittin Pachtrachai, Petmongkon Pornpichitsuwan, Wachiravit Modecrua, Touchapon Kraisingkorn

机构 * Amity Research and Application Center (ARAC)(阿米蒂研究与应用中心)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文提出了一种端到端框架,通过历史通话记录构建和评估对话式AI助手,利用知识提取和RAG整合提升事实准确性和鲁棒性。

Comments 9 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21875 2026-02-04 cs.CL 83%

LUMINA: Detecting Hallucinations in RAG System with Context-Knowledge Signals

LUMINA:通过上下文-知识信号检测RAG系统中的幻觉

Samuel Yeh, Sharon Li, Tanwi Mallick

机构 * Department of Computer Science, University of Wisconsin-Madison(威斯康星大学麦迪逊分校计算机科学系) Argonne National Laboratory(阿贡国家实验室)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 LUMINA通过上下文-知识信号检测RAG系统中的幻觉,利用分布距离和token演变测量,实现高准确率和实用性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18267 2026-01-27 cs.IR 83%

Orchestrating Specialized Agents for Trustworthy Enterprise RAG

协调专用代理以实现可信的企业RAG

Xincheng You, Qi Sun, Neha Bora, Huayi Li, Shubham Goel, Kang Li, Sean Culatana

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.IR

AI总结 ADORE通过结构化记忆库和迭代协调机制,提升企业RAG在高风险决策中的可追溯性和证据完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14949 2026-01-27 cs.IR 83%

What Should I Cite? A RAG Benchmark for Academic Citation Prediction

我应该引用什么?一个用于学术引用预测的RAG基准

Leqi Zheng, Jiajun Zhang, Canzhi Chen, Chaokun Wang, Hongwei Li, Yuying Li, Yaoxin Mao, Shannan Yan, Zixin Song, Zhiyuan Feng, Zhaolu Kang, Zirong Chen, Hang Zhang, Qiang Liu, Liang Wang, Ziyang Liu

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.IR

AI总结 CiteRAG提出一个用于学术引用预测的RAG基准,通过多层次检索策略和生成器,评估大型语言模型在引用预测中的性能。

Journal ref WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09122 2026-01-19 cs.SE cs.AI 83%

Vendor-Aware Industrial Agents: RAG-Enhanced LLMs for Secure On-Premise PLC Code Generation

面向供应商的工业代理:增强型LLM用于安全本地PLC代码生成

Joschka Kersting, Michael Rummel, Gesa Benndorf

机构 * Centre for Machine Learning(机器学习中心) Fraunhofer IOSB-INA(弗劳恩霍夫IOSB-INA研究所) FA-EDC Mitsubishi Electric Europe(三菱电机欧洲)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.AI

AI总结 本文提出了一种基于RAG增强的LLM方法,用于在低数据域中安全生成本地PLC代码,通过提示工程和定向检索提升代码生成质量。

Comments ICIT2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12071 2026-01-19 cs.IR 83%

T$^2$-RAGBench: Text-and-Table Benchmark for Evaluating Retrieval-Augmented Generation

T$^2$-RAGBench:用于评估检索增强生成的文本与表格基准

Jan Strich, Enes Kutay Isgorur, Maximilian Trescher, Chris Biemann, Martin Semmann

专题命中 RAG评测 :retrieval-augmented generation(title);retrieval augmented generation(abstract);RAG(abstract);分类 cs.IR

AI总结 T$^2$-RAGBench是一个用于评估检索增强生成在文本和表格数据上性能的基准,通过上下文无关的问题测试RAG方法,发现Hybrid BM25在处理此类数据时表现最佳,但仍然对最先进的模型构成挑战。

Comments Accepted to EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24253 2026-01-14 cs.CL 83%

MRAG-Suite: A Diagnostic Evaluation Platform for Visual Retrieval-Augmented Generation

MRAG-Suite:一个用于视觉检索增强生成的诊断评估平台

Yuelyu Ji, Wuwei Lan, Patrick NG

机构 * University of Pittsburgh(匹兹堡大学)

专题命中 RAG评测 :retrieval-augmented generation(title,abstract);RAG(abstract);分类 cs.CL

AI总结 MRAG-Suite通过引入难度和歧义过滤策略及诊断工具MM-RAGChecker,系统评估视觉检索增强生成的性能与常见幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01785 2026-01-06 cs.IR cs.LG 83%

SRAS: A Lightweight Reinforcement Learning-based Document Selector for Edge-Native RAG Pipelines

SRAS:一种基于强化学习的轻量级文档选择器用于边缘原生RAG流水线

Rajiv Chaitanya Muttur

机构 * Dayananda Sagar College of Engineering, Bangalore, India(达扬达萨加尔工程学院,班加罗尔,印度)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.IR

AI总结 SRAS通过强化学习训练出轻量级文档选择器,适用于边缘原生RAG流水线,实现低延迟和高生成质量。

Comments Presented at ICEdge 2025; nominated for Best Paper Award

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01341 2026-01-06 cs.CL 83%

Reasoning Over Recall: Evaluating the Efficacy of Generalist Architectures vs. Specialized Fine-Tunes in RAG-Based Mental Health Dialogue Systems

基于回忆的推理:评估基于RAG的心理健康对话系统中通用架构与专门微调的有效性

Md Abdullah Al Kafi, Raka Moni, Sumit Kumar Banshal

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文通过比较通用推理模型与领域特定微调模型,发现通用模型在同理心和上下文理解方面表现更优,表明强大的推理能力比专门训练更能提升心理健康对话系统的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00254 2026-01-05 cs.SE cs.AI 83%

An Empirical Evaluation of LLM-Based Approaches for Code Vulnerability Detection: RAG, SFT, and Dual-Agent Systems

基于大型语言模型的代码漏洞检测方法实证评估:RAG、SFT和双智能体系统

Md Hasan Saju, Maher Muhtadi, Akramul Azim

机构 * Department of Electrical, Computer, and Software Engineering(电气、计算机与软件工程系) Ontario Tech University(安大略技术大学)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.AI

AI总结 本文通过实证评估,比较了RAG、SFT和双智能体系统在代码漏洞检测中的有效性,发现RAG在准确率和F1分数上表现最佳,SFT和双智能体系统也展示了良好的性能,证明了领域专业知识对LLM在实际漏洞检测中的重要性。

Journal ref https://conf.researchr.org/home/cascon-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04235 2026-01-01 cs.CL 83%

Addressing Hallucinations with RAG and NMISS in Italian Healthcare LLM Chatbots

通过RAG和NMISS解决意大利医疗LLM聊天机器人中的幻觉

Maria Paola Priola

机构 * Department of Economics and Business, University of Cagliari(经济与商业系,卡利亚里大学)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文通过RAG和NMISS方法有效缓解和检测LLM中的幻觉问题,验证了GPT-4和NMISS对提升医疗领域LLM性能的显著效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02800 2025-12-23 cs.CL 83%

Survey and Experiments on Mental Disorder Detection via Social Media: From Large Language Models and RAG to Agents

面向社交媒体的抑郁症检测综述与实验:从大型语言模型和RAG到代理

Zhuohan Ge, Darian Li, Yubo Wang, Nicole Hu, Xinyi Zhu, Haoyang Li, Xin Zhang, Mingtao Zhang, Shihao Qi, Yuming Xu, Han Shi, Chen Jason Zhang, Qing Li

机构 * The Hong Kong Polytechnic University(香港理工大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.CL

AI总结 本文综述并实验了基于社交媒体的抑郁症检测方法,探讨了LLM、RAG和代理系统在提升检测可靠性与推理能力中的应用。

Comments 20 pages, 10 figures. This is an extension of ICDEW 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14069 2025-12-09 cs.IR 83%

Process vs. Outcome Reward: Which is Better for Agentic RAG Reinforcement Learning

过程奖励与结果奖励:哪种对代理RAG强化学习更有效

Wenlin Zhang, Xiangyang Li, Kuicai Dong, Yichao Wang, Pengyue Jia, Xiaopeng Li, Yingyi Zhang, Derong Xu, Zhaocheng Du, Huifeng Guo, Ruiming Tang, Xiangyu Zhao

专题命中 RAG评测 :RAG(title,abstract);retrieval-augmented generation(abstract);分类 cs.IR

AI总结 ReasonRAG通过过程级奖励提升代理RAG强化学习性能,以更高效训练和更少数据实现更优结果

详情

展开后加载摘要…

URL PDF HTML 收藏