AtelierEval: Agentic Evaluation of Humans & LLMs as Text-to-Image Prompters
AtelierEval: 人类与LLM作为文本到图像提示器的代理评估
机构 * New York University Abu Dhabi(纽约大学阿布扎克校区) ; Nanyang Technological University(南洋理工大学) ; Zhejiang University(浙江大学) ; University of Electronic Science and Technology of China(电子科技大学) ; The Hong Kong Polytechnic University(香港理工大学)
AI总结 本文提出AtelierEval,首个统一基准,通过360个专家设计的任务量化提示能力,引入技能基于的记忆增强代理评估器,实现与人类专家的高相关性,验证了提示器在图像增强方向的优越性。
Comments Accepted by ICML 2026