LACY: A Vision-Language Model-based Language-Action Cycle for Self-Improving Robotic Manipulation
LACY: 基于视觉-语言模型的语言-动作循环用于自我改进的机器人操作
机构 * Department of Electrical and Computer Engineering, Univ. of Minnesota(电气与计算机工程系,明尼苏达大学)
专题命中 GUI与屏幕智能体 :vision-language model(title,abstract);grounding(abstract);分类 cs.AI
AI总结 提出LACY框架,通过联合学习语言到动作、动作到语言和语言一致性验证三个任务,实现机器人操作的自我改进,平均任务成功率提升56.46%。
Comments Accepted to ICRA 2026. Project page: https://vla2026.github.io/LACY/