CodeRL+: Improving Code Generation via Reinforcement with Execution Semantics Alignment
CodeRL+: 通过执行语义对齐改进代码生成
机构 * School of Computer Science, Peking University(北京大学计算机科学系) ; Tongyi Lab, Alibaba Group(阿里集团通义实验室) ; School of Computer Science, Wuhan University(武汉大学计算机科学系)
专题命中 安全训练 :alignment(title,abstract);分类 cs.CL、cs.AI
AI总结 本文提出CodeRL+,通过将执行语义对齐整合到RLVR训练流程中,提升代码生成的准确性,实验显示其在pass@1指标上平均提升4.6%。
Comments Accepted by ACL 2026