Evaluating Reasoning Fidelity in Visual Text Generation
评估视觉文本生成中的推理保真度
机构 * Stony Brook University(石桥大学)
专题命中 文生图 :text-to-image(abstract);分类 cs.CV
AI总结 通过长文本渲染、事实知识探测、上下文理解和多步推理等任务,评估当前文本到图像模型在视觉文本生成中是否忠实保持推理能力,发现其常产生语义错误和逻辑不一致,与纯文本模型存在显著差距。
Comments Peer reviewed and accepted at CVPR 2026 at the GRAIL-V (Grounded Retrieval and Agentic Intelligence for Vision-Language) workshop (non-archival track)