Deciding When to Rely on Visual Information: Gated Multimodal Fusion in Sequential Recommendation
何时依赖视觉信息:序列推荐中的门控多模态融合
专题命中 融合架构与评测 :multimodal fusion(title)
AI总结 该研究提出VisGate框架,基于物品和用户上下文自适应融合多模态信号,揭示视觉效用随物品、交互稀疏性变化的规律,实现更精准的序列推荐并可解释视觉信息的作用。
Comments 8 pages, 6 figures, Accepted at CARS @ RecSys 2026