CL4SE: Benchmarking Context Learning on Software Engineering
CL4SE:软件工程中基于上下文学习的基准测试
专题命中 代码评测 :code generation(abstract);分类 cs.SE
AI总结 本文提出CL4SE基准测试,系统分类四种软件工程特定上下文类型,通过高质量数据集和五种主流LLM评估,展示上下文学习在代码生成、审查等任务中的性能提升。
Comments 34 pages, 4 figures
AI 大模型
代码生成、软件工程智能体、程序修复、测试生成和开发者工具。
CL4SE:软件工程中基于上下文学习的基准测试
专题命中 代码评测 :code generation(abstract);分类 cs.SE
AI总结 本文提出CL4SE基准测试,系统分类四种软件工程特定上下文类型,通过高质量数据集和五种主流LLM评估,展示上下文学习在代码生成、审查等任务中的性能提升。
Comments 34 pages, 4 figures
CodeWiki: 评估AI生成大规模代码库整体文档的能力
专题命中 代码评测 :repository(abstract);分类 cs.SE
AI总结 CodeWiki提出一个统一框架,用于生成多语言代码库的自动化文档,通过层级分解、递归多代理处理和多模态合成,提升文档质量,实验显示其在高脚本语言上的改进显著。
Comments Accepted at ACL 2026