AtManRL: Towards Faithful Reasoning via Differentiable Attention Saliency
AtManRL:通过可微注意力显著性实现更忠实的推理
机构 * Aleph Alpha Research Lab(Aleph Alpha研究实验室) ; TU Darmstadt(图林根大学) ; Hessian.AI Lab(黑森AI实验室)
专题命中 复杂问题求解 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 本文提出AtManRL方法,通过可微注意力操控学习更忠实的推理过程,结合GRPO框架优化正确性与可解释性,实验证明能识别关键推理token并提升模型透明度。
Comments 14 pages, 8 figures, 1 table