2606.07962
2026-06-09
cs.CV
新提交
50%
ChronoPhyBench: Do MLLMs Truly Understand the World or Merely Exploit Language Priors?
ChronoPhyBench:多模态大语言模型真正理解世界还是仅仅利用语言先验?
Bin Zhu, Yanhao Jia, Kexin Zhao, Jie Wang, Munan Ning, Hao Li, Yuwei Niu, Tanqing Sun, Huangchong Yan, Mingjun Pan, Xinyi Wu, Qishen Yin, Yunyang Ge, Shuai Zhao, Li Yuan
机构
*
Peking University, Shenzhen Graduate School(北京大学深圳研究生院)
;
Peng Cheng Laboratory(鹏城实验室)
;
Rabbitpre Intelligence
;
Nanyang Technological University(南洋理工大学)
;
Tsinghua University(清华大学)
专题命中
推理评测
:reasoning(abstract)
AI总结
提出ChronoPhyBench基准,通过视频上下文和文本描述强制模型进行物理状态推理,揭示当前开源模型物理推理能力仍处初级阶段。