Claw-SWE-Bench: A Benchmark for Evaluating OpenClaw-style Agent Harnesses on Coding Tasks
Claw-SWE-Bench:评估OpenClaw风格代理框架在编码任务上的基准
机构 * TokenRhythm Technologies(TokenRhythm 技术公司) ; Infinigence AI ; Peking University(北京大学) ; City University of Hong Kong(香港城市大学) ; SEE Fund(SEE 基金) ; Shanghai Jiaotong University(上海交通大学) ; Beijing Jiaotong University(北京交通大学) ; Tsinghua University(清华大学)
AI总结 提出Claw-SWE-Bench基准,通过适配器协议统一评估异构代理框架,发现适配器设计对编码性能至关重要,且模型和框架选择显著影响通过率与成本。