Learning When to Listen: Gated Affect Fusion for Human Motion Prediction
学习何时倾听:用于人体运动预测的门控情感融合
机构 * University of Oxford(牛津大学)
专题命中 音视频/视觉语言融合 :multimodal fusion(abstract);分类 cs.CV
AI总结 提出门控情感变换器(GAT)动态调节跨模态信息流,解决无约束视频中情感特征与姿态融合的噪声问题,证明面部情感仅在短中期(如30帧)提供有限预测线索。