VCIFBench: Evaluating Complex Instruction Following for Video Understanding
VCIFBench:评估视频理解中的复杂指令遵循能力
机构 * School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) ; Engineering Research Center of Knowledge-Driven Human-Machine Intelligence, Jilin University(知识驱动人机智能工程研究中心,吉林大学) ; International Center of Future Science, Jilin University(未来科学国际中心,吉林大学)
专题命中 其他VLM :multimodal large language model(abstract);MLLM(abstract_cn)
AI总结 提出VCIFBench基准,通过混合验证流水线评估多模态大模型在视频理解中遵循内容、格式、风格和结构约束的复杂指令能力,实验表明联合约束满足仍具挑战,DPO训练可提升性能。