Vision2Code: A Multi-Domain Benchmark for Evaluating Image-to-Code Generation
Vision2Code:一个多领域评估图像到代码生成的基准
机构 * Duke University(杜克大学)
专题命中 文档图表理解 :VLM(abstract,abstract_cn);vision-language model(abstract);分类 cs.CV、cs.LG
AI总结 Vision2Code提出一个无需参考代码的多领域图像到代码生成评估框架,通过2169个测试示例评估模型生成代码的质量,发现性能依赖于领域,且通过筛选器的模型输出可提升生成能力。
Comments Project page: https://image2code.github.io/vision2code/