arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-04-08 至 2026-04-08 共收录 1 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 知识库问答 1 篇

2604.05051 2026-04-08 cs.CL cs.AI 73%

This Treatment Works, Right? Evaluating LLM Sensitivity to Patient Question Framing in Medical QA

这种治疗有效吗?评估LLM在医疗问答中对患者问题表述的敏感性

Hye Sun Yun, Geetika Kapoor, Michael Mackert, Ramez Kouzy, Wei Xu, Junyi Jessy Li, Byron C. Wallace

机构 * Northeastern University(东北大学) UC Berkeley(加州大学伯克利分校) UT Austin(德克萨斯大学奥斯汀分校) UT MD Anderson Cancer Center(德克萨斯大学MD安德森癌症中心) Georgia Institute of Technology(佐治亚理工学院)

专题命中 知识库问答 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

AI总结 研究评估了LLM在医疗问答中对问题表述方式的敏感性,发现不同表述方式会导致不一致结论,尤其在多轮对话中更为明显,强调了在高风险场景中需重视表述鲁棒性。

Comments 31 pages, 4 tables, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏