arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

2026-03-16 至 2026-03-16 共收录 1 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 长文档RAG 1 篇

2603.12963 2026-03-16 cs.CL 57%

Long-form RewardBench: Evaluating Reward Models for Long-form Generation

长文奖励基准:评估长文生成的奖励模型

Hui Huang, Yancheng He, Wei Liu, Muyun Yang, Jiaheng Liu, Kehai Chen, Bing Xu, Conghui Zhu, Hailong Cao, Tiejun Zhao

专题命中 长文档RAG :RAG(abstract);分类 cs.CL

AI总结 本文提出Long-form RewardBench,首个专为长文生成设计的奖励模型评估平台,通过五个子任务评估20+主流模型,揭示分类与生成模型在长文奖励建模上的差异。

Comments Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏