MCBench: A Multicontext Safety Assessment Benchmark for Omni Large Language Models
MCBench:面向全能大语言模型的多上下文安全评估基准
机构 * Monash University(墨尔本大学) ; Defence Science and Technology Group(国防科学与技术集团)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
AI总结 针对现有多模态安全基准仅处理视觉输入的局限,提出MCBench基准,包含1196个跨四类安全场景的测试,要求整合多模态信息进行安全评估,揭示当前全能大语言模型在跨模态安全推理上的不足。