Evaluating Stochastic Collapse and Implicit Bias in Multimodal Large Language Models
评估多模态大语言模型中的随机坍缩与隐式偏差
机构 * Fudan University(复旦大学) ; Beihang University(北航) ; JD.com(京东)
专题命中 幻觉与鲁棒性 :multimodal large language model(title,abstract)
AI总结 提出RandomBench基准测试,通过熵和分布偏差指标揭示多模态大语言模型在逻辑中性场景下存在随机坍缩现象,即无法维持均匀随机性。