TRACER: A Semantic-Aware Framework for Fine-Grained Contamination Detection in Code LLMs
TRACER: 一种用于代码大语言模型中细粒度污染检测的语义感知框架
机构 * Purdue University West Lafayette, IN(帕克大学韦斯特拉法叶分校) ; University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
专题命中 评测与基准 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);post-training(abstract)
AI总结 提出TRACER框架,通过三级语义重叠和粗到细流水线检测代码LLM中的细粒度数据污染,在基准测试中F1达0.91。
Comments 21 pages, 2 figures, 15 tables