PARALLEL: A Prefrontal-Aligned Reinforcement inspired Approach for Language-Model Learning under Explicit Limits
PARALLEL:显式约束下语言模型学习的前额叶对齐强化启发式方法
专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI
AI总结 PARALLEL是一种前额叶对齐的强化启发式语言模型学习方法,通过分配样本相关更新强度提升适配效率,在多任务上保留高性能且适配轨迹更稳定,支持高效稳定的部署后流式适配。
Comments 8 pages, 3 figures, and 5 tables