DesignBench: A Comprehensive Benchmark for MLLM-based Front-end Code Generation
DesignBench: 一个全面的基于MLLM的前端代码生成基准测试
专题命中 GUI与屏幕智能体 :MLLM(title,abstract);multimodal large language model(abstract);分类 cs.AI
AI总结 DesignBench针对MLLM在前端工程中的应用,提出多框架、多任务的评估基准,涵盖生成、编辑和修复三个任务,通过900个网页样本分析模型性能,揭示框架特定限制和任务瓶颈。