2602.11937
2026-03-30
cs.LG
79%
Extending Puzzle for Mixture-of-Experts Reasoning Models with Application to GPT-OSS Acceleration
扩展谜题以用于专家混合推理模型的推理,应用于GPT-OSS加速
Akhiad Bercovich, Nir Ailon, Vladimir Anisimov, Tomer Asida, Nave Assaf, Mohammad Dabbah, Ido Galil, Amnon Geifman, Yonatan Geifman, Izhak Golan, Roi Koren, Itay Levy, Zach Moshe, Pavlo Molchanov, Najeeb Nabwani, Mostofa Patwary, Omri Puny, Tomer Ronen, Itamar Schen, Elad Segal, Ido Shahaf, Oren Tropp, Ran Zilberstein, Ran El-Yaniv
专题命中
规划推理
:reasoning(title,abstract);分类 cs.LG
AI总结
本文通过扩展Puzzle框架优化GPT-OSS模型,结合MoE剪枝、注意力替换、量化和强化学习提升推理效率,实现部署优化并提高请求级效率。