LPO: Towards Accurate GUI Agent Interaction via Location Preference Optimization
LPO:通过位置偏好优化实现更准确的GUI代理交互
机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) ; Alibaba Group(阿里巴巴集团) ; The Chinese University of Hong Kong(香港中文大学) ; Nanjing University of Science and Technology(南京理工大学) ; The Hong Kong University of Science and Technology (Guangzhou)(广州香港科学与技术大学)
AI总结 本文提出LPO方法,通过位置偏好优化提升GUI交互精度,利用信息熵预测交互位置并引入动态位置奖励函数,实验表明其在离线和在线评估中均取得最佳性能。
Comments Accepted by ACL 2026 Findings