Mitigating LLM-based p-Hacking by Preregistering for the Next LLM
通过预注册下一个LLM来缓解基于LLM的p-hacking
机构 * Johns Hopkins University(约翰霍普金斯大学) ; Carnegie Mellon University(卡内基梅隆大学)
专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 提出一种协议,通过预注册实验和合格模型,并在预注册后发布的第一个合格LLM上运行,以缓解LLM研究中的p-hacking问题。实验表明该协议能有效阻止73.9%和72.7%的p-hack转移。