STAR-PólyaMath: Multi-Agent Reasoning under Persistent Meta-Strategic Supervision
STAR-PólyaMath: 多智能体在持久元策略监督下的推理
机构 * Tsinghua University(清华大学) ; Microsoft Research(微软研究院) ; New York University(纽约大学) ; MIT(麻省理工学院)
专题命中 数学推理 :reasoning(title,abstract);planning(abstract);verifier(abstract);分类 cs.CL、cs.AI
AI总结 本文提出STAR-PólyaMath多智能体框架,通过元级监督和结构化的推理-验证交互系统性解决数学推理中的幻觉积累、记忆碎片化和推理工具平衡问题,并在多个顶级竞赛基准上取得最佳成绩。
Comments 25 pages, 4 figures. Code: https://github.com/Julius-Woo/STAR-PolyaMath