Reward Design for Physical Reasoning in Vision-Language Models
用于视觉语言模型中物理推理的奖励设计
机构 * Pacific Northwest National Laboratory(太平洋西北国家实验室)
专题命中 视觉推理 :vision-language model(title);VLM(abstract,abstract_cn);vision language model(abstract);分类 cs.CV、cs.AI
AI总结 本文探讨了奖励设计对视觉语言模型物理推理的影响,通过对比不同奖励信号发现,基于准确性的奖励在多数领域表现最佳,而基于注意力权重的奖励提升了空间推理能力。