Learned or Memorized ? Quantifying Memorization Advantage in Code LLMs
学习还是记忆?量化代码大语言模型中的记忆优势
专题命中 程序修复 :code generation(abstract);program repair(abstract);分类 cs.SE
AI总结 本文通过扰动方法量化代码LLM的记忆优势,评估8个开源代码LLM在19个基准测试中的表现,发现任务和模型差异显著,部分基准测试显示低敏感度,挑战了数据泄露的常见担忧。
Comments 12 pages, 12 figures. Accepted at ICSE 2026 (to appear)