Reasoning in a Combinatorial and Constrained World: Benchmarking LLMs on Natural-Language Combinatorial Optimization
在组合与约束世界中的推理:在自然语言组合优化上对LLM的基准测试
机构 * Eindhoven University of Technology(埃因霍温理工大学) ; Brandenburg University of Technology(勃兰登堡工业大学) ; Nanyang Technological University(南洋理工大学) ; Delft University of Technology(代尔夫特理工大学) ; Southeast University(东南大学)
专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI
AI总结 本文提出NLCO基准测试,评估LLM在组合优化中的推理能力,涵盖43个问题,通过四层分类体系进行细粒度评估,发现随着问题规模增大,LLM的性能下降,尤其是在图结构问题和瓶颈目标上表现较差。