Reasoning Models Struggle to Control their Chains of Thought
推理模型难以控制其推理链
机构 * NYU(纽约大学) ; MATS(马歇尔应用科学与技术学院) ; UCL(伦敦大学学院) ; UPenn(宾夕法尼亚大学) ; OpenAI
专题命中 测试时计算 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);test-time compute(abstract)
AI总结 研究发现推理模型的CoT可控性低于输出可控性,且受模型规模、训练和问题难度影响,建议未来跟踪CoT可控性以维持监控有效性。