Agentic Retrieval and Reinforcement Learned Equation Chains: A Controlled Generation Framework for Complex and Novel Physics Word Problems
智能检索与强化学习方程链:面向复杂新颖物理文字题的可控生成框架
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 其他Agent :agentic(title,abstract);分类 cs.AI、cs.CL
AI总结 提出ARVRE两阶段框架,通过离线时序差分学习构建有效物理方程链,结合智能检索增强生成控制问题结构与难度,再由大语言模型生成自然语言问题,实现复杂、新颖且可解的物理文字题生成。