OR-Action: Multi-Role Video Understanding with Fine-Grained Actions
OR-Action: 细粒度动作的多角色视频理解
机构 * Technical University of Munich(慕尼黑工业大学) ; Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) ; Carl Zeiss AG(卡尔蔡司股份公司)
专题命中 动作与事件理解 :video understanding(title);分类 cs.CV
AI总结 针对手术室活动理解中场景图方法缺乏时间建模的问题,提出基于公开数据集的细粒度多角色动作基准,并引入纯视觉时序模型,显著优于图方法,同时提出多视角到单视角特征对齐策略提升单视角性能。