See2Refine: Vision-Language Feedback Improves LLM-Based eHMI Action Designers
See2Refine:视觉语言反馈提升基于LLM的eHMI动作设计
机构 * The University of Tokyo(东京大学) ; University College London(伦敦大学学院) ; Google(谷歌)
专题命中 GUI与屏幕智能体 :VLM(abstract,abstract_cn);vision-language model(abstract);分类 cs.AI
AI总结 See2Refine通过视觉语言模型的反馈机制,提升基于大语言模型的eHMI动作设计能力,实现无需人工干预的闭环改进,优于传统提示和人工指定基线。
Comments Accepted to ACL2026