How Blind and Low-Vision Individuals Prefer Large Vision-Language Model-Generated Scene Descriptions
盲人和低视力者如何偏好大型视觉-语言模型生成的场景描述
专题命中 其他VLM :vision-language model(title,abstract);分类 cs.CV、cs.AI
AI总结 研究探讨了盲人和低视力用户对大型视觉-语言模型生成场景描述的偏好,通过用户研究评估了六种描述类型,发现用户对描述的充分性和简洁性存在较大差异,提出需构建以盲人和低视力用户为中心的评估指标。
Comments This paper has been superseded by version 2 of arXiv:2510.00766