MultiFileTest: A Multi-File-Level LLM Unit Test Generation Benchmark and Impact of Error Fixing Mechanisms
MultiFileTest:一个多文件级LLM单元测试生成基准及错误修复机制的影响
机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) ; Salesforce Research(Salesforce研究院) ; Scale AI
专题命中 测试生成 :unit test generation(title,abstract);分类 cs.SE、cs.CL
AI总结 本文提出MultiFileTest基准,评估多文件级代码的单元测试生成性能,发现前沿LLM表现一般,且存在执行及级联错误,进一步评估了错误修复机制的效果。
Comments Published at ACL 2026 (Findings)