NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment
NovBench:在学术论文新颖性评估中评估大语言模型
机构 * School of Economics and Management, Nanjing University of Science and Technology(南京理工大学经济管理学院) ; School of Electronic Engineering and Computer Science, Queen Mary University of London(伦敦玛丽女王大学电子工程与计算机科学学院) ; School of Management, Anhui University(安徽大学管理学院)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
AI总结 NovBench通过1684篇论文与评审对的基准测试,评估大语言模型在新颖性评估中的能力,揭示当前模型在科学新颖性理解上的不足,强调需改进的细调策略。
Comments ACL 2026