A Task-Level Evaluation of AI Agents in Open-Source Projects
对开源项目中AI代理的任务级评估
专题命中 Agent评测 :AI agent(title,abstract);分类 cs.SE
AI总结 本文评估了五个AI代理在开源项目中的表现,发现Codex在PR接受率上表现优异,而Copilot在审查讨论量上领先,但提交质量因任务类型而异。
Comments 5 pages, accepted at MSR Mining Challenge 2026