TensorBench: Benchmarking Coding Agents on a Compiler-Based Tensor Framework
TensorBench: 在基于编译器的张量框架上对编码智能体进行基准测试
机构 * Department of Computer Science, Stanford University(计算机科学系,斯坦福大学)
专题命中 软件智能体 :coding agent(title,abstract);repository(abstract);分类 cs.CL、cs.AI
AI总结 本文提出 TensorBench,一个包含199个特征添加和重构任务的基准测试,用于评估编码智能体在基于编译器的张量框架上的表现,并通过测试套件自动评分。