arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-05-05 至 2026-05-05 共收录 2 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 知识库问答 2 篇

2605.01471 2026-05-05 cs.SE cs.AI 70%

Practical Limits of Autonomous Test Repair: A Multi-Agent Case Study with LLM-Driven Discovery and Self-Correction

自主测试修复的实践极限:基于LLM驱动发现与自我校正的多智能体案例研究

Hyukjoo Lee

机构 * Independent Researcher(独立研究者)

专题命中 知识库问答 :RAG(abstract,abstract_cn);分类 cs.AI

AI总结 本文通过多智能体系统在企业UI测试中的应用,探讨自主测试的限制,发现受限自主性能提升系统稳定性与可靠性,需结合验证边界和人工监督。

Comments Industrial case study; submitted for review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01077 2026-05-05 cs.CL 70%

Teaching LLMs Brazilian Healthcare: Injecting Knowledge from Official Clinical Guidelines

教大语言模型巴西医疗:注入官方临床指南的知识

Hugo Abonizio, Filipe Rocha Lopes, Roberto Lotufo, Rodrigo Nogueira

机构 * FEEC, UNICAMP(UNICAMP电子工程学院) Maritaca AI

专题命中 知识库问答 :RAG(abstract,abstract_cn);分类 cs.CL

AI总结 本文通过适配Qwen2.5-14B-Instruct模型,生成合成数据并采用持续预训练和GRPO方法,构建了HealthBench-BR和PCDT-QA基准,实现了在巴西医疗领域上的高准确率表现。

详情

展开后加载摘要…

URL PDF HTML 收藏