Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving
长周期推理代理用于竞赛级数学问题求解
机构 * Shanghai AI Laboratory(上海人工智能实验室) ; Shanghai Jiao Tong University(上海交通大学) ; MMLab ; The Chinese University of Hong Kong(香港中文大学) ; ICMAT Spanish National Research Council(西班牙国家科研 council) ; The High School Affiliated to Renmin University of China(中国人民大学附属高中) ; Ren Hui Academy of Beijing(北京润辉学院)
专题命中 数学推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL、cs.AI
AI总结 本文提出Intern-S1-MO,通过多轮分层推理和OREAL-H框架,突破IMO级数学问题的上下文限制,实现26/35分的优异成绩。