ViGoR-Bench: How Far Are Visual Generative Models From Zero-Shot Visual Reasoners?
ViGoR-Bench:视觉生成模型距离零样本视觉推理还有多远?
机构 * Tsinghua University(清华大学) ; The University of Hong Kong(香港大学) ; Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)
AI总结 本文提出ViGoR-Bench基准,通过跨模态覆盖、双轨评估、证据驱动裁判和细粒度分析,揭示生成模型在因果推理和空间认知上的缺陷,验证了先进模型在零样本推理上的不足。