FineBench: Benchmarking and Enhancing Vision-Language Models for Fine-grained Human Activity Understanding
FineBench: 细粒度人类活动理解的视觉-语言模型基准测试与增强
机构 * National Taiwan University(国立台湾大学) ; Google(谷歌) ; Independent Researcher(独立研究员)
专题命中 视频问答 :video understanding(abstract);分类 cs.CV
AI总结 针对视觉-语言模型在细粒度人类活动理解上的不足,提出包含密集标注的长视频问答基准FineBench和增强框架FineAgent。
Comments CVPR'26 (Workshop on Video Large Language Models). Project Page: https://joslefaure.github.io/assets/html/finebench.html