LoCoT2V-Bench: Benchmarking Long-Form and Complex Text-to-Video Generation
LoCoT2V-Bench: 长文本与复杂文本到视频生成的基准测试
机构 * Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳研究院) ; The University of Hong Kong(香港大学)
专题命中 视频生成 :video generation(title,abstract);text-to-video(title,abstract);long video(abstract);分类 cs.CV
AI总结 针对长视频生成在复杂文本输入下的评估挑战,提出包含多场景提示与层次元数据的基准LoCoT2V-Bench,并设计多维度评估框架LoCoT2V-Eval,实验发现模型在细粒度文本-视频对齐和角色一致性方面存在显著不足。
Comments Accepted by ICML 2026 (Regular)