CBX-Bench: A Human-Aligned MLLM Council for Benchmarking Concept Bottleneck Model Explanations
CBX-Bench:用于评估概念瓶颈模型解释的人类对齐多模态大语言模型委员会
专题命中 其他VLM :MLLM(title,summary_cn);multimodal large language model(abstract);分类 cs.CV
AI总结 该研究开发了人类对齐的多模态大语言模型(MLLM)委员会,构建了CBX-Bench基准,实现了概念瓶颈模型(CBM)解释的可扩展定量评估,其在人类偏好排名上的恢复率达70%以上。