SOLAR-RL: Semi-Online Long-horizon Assignment Reinforcement Learning
SOLAR-RL:半在线长 horizon 分配强化学习
机构 * vivo AI Lab(vivo人工智能实验室) ; Zhejiang Lab(浙江实验室) ; CUHK MMLab(香港大学多模态实验室) ; Hubei University(湖北省大学) ; Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院)
专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.AI、cs.LG
AI总结 SOLAR-RL通过整合全局轨迹信息到离线学习中,提升GUI任务的长horizon完成率和鲁棒性,提供高效样本利用的自主导航方案。
Comments 14 pages, 11 figures. Accepted to Findings of the Association for Computational Linguistics: ACL 2026