PolySLGen: Online Multimodal Speaking-Listening Reaction Generation in Polyadic Interaction
PolySLGen:多对多交互中的在线多模态说话-倾听反应生成
机构 * Computer Vision Lab, Delft University of Technology(代尔夫特理工大学计算机视觉实验室) ; Honda Research Institute Japan(本田日本研究所)
专题命中 多模态生成 :multimodal(title,abstract);multi-modal(abstract);分类 cs.CV
AI总结 本文提出PolySLGen框架,用于多对多交互中的多模态反应生成,通过融合姿态和社交信号提升对话连贯性和真实感。