MonitorBench: A Comprehensive Benchmark for Chain-of-Thought Monitorability in Large Language Models
MonitorBench: 一个用于大型语言模型链式思维可监控性的综合基准
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; University of Washington(华盛顿大学) ; University of California San Diego(加州大学圣地亚哥分校)
专题命中 推理评测 :chain-of-thought(title);reasoning(abstract);CoT(abstract);分类 cs.AI
AI总结 本文提出MonitorBench,通过1514个测试实例和两种压力测试设置,评估LLM链式思维的可监控性,发现决策关键因素对中间推理过程的影响程度影响可监控性,更高级的LLM表现出更低的可监控性。
Comments COLM 2026