Are Large Vision-Language Models Ready to Guide Blind and Low-Vision Individuals?
大视觉-语言模型是否准备好指导盲人和低视力者?
机构 * SKT ; KAIST AI(韩国科学技术院人工智能) ; NAVER ; Theia Insights
专题命中 VLM训练与架构 :vision-language model(title,abstract);VLM(abstract);分类 cs.CV、cs.AI
AI总结 本文提出统一框架,通过用户研究和定制数据集,开发出更高效的评估器,提升大视觉-语言模型在盲人和低视力用户导航中的应用性能。
Comments 42 pages, 14 figures, 28 tables