Stop When Reasoning Converges: Semantic-Preserving Early Exit for Reasoning Models
停止当推理收敛:用于推理模型的语义保留早退出
机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) ; Google Research(谷歌研究) ; University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; Politecnico di Milano(米兰理工学院)
专题命中 测试时计算 :reasoning(title,abstract);CoT(abstract,abstract_cn);分类 cs.CL
AI总结 本文提出PUMA框架,通过识别推理层面的语义冗余信号,实现语义保留的早退出,从而在保持准确性和推理链完整性的同时减少token消耗。
Comments under review