Pushing the Boundaries of Natural Reasoning: Interleaved Bonus from Formal-Logic Verification
突破自然推理的边界:来自形式逻辑验证的交错奖励
专题命中 推理与问题求解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG
AI总结 提出形式逻辑验证引导框架,通过交错验证与生成过程实时纠正推理错误,结合两阶段训练,在数学、逻辑和通用推理基准上显著提升大模型性能。
Comments Accepted by ICML 26