FDM-Bench: A Comprehensive Benchmark for Evaluating Large Language Models in Additive Manufacturing Tasks
FDM-Bench:用于评估大型语言模型在增材制造任务中的综合基准
机构 * Department of Mechanical Science and Engineering, University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校机械科学与工程系) ; Coordinated Science Laboratory, University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校协调科学实验室) ; Department of Mechanical and Aerospace Engineering, Rutgers University(罗格斯大学机械与航空航天工程系) ; Department of Mechanical Engineering, University of Michigan(密歇根大学机械工程系)
专题命中 Agent评测 :planning(abstract);分类 cs.LG
AI总结 本文提出FDM-Bench基准,用于评估大型语言模型在增材制造任务中的能力,通过用户查询和G代码样本评估不同模型的性能,发现闭源模型在检测G代码异常方面表现更优。