MoXaRt: Audio-Visual Object-Guided Sound Interaction for XR
MoXaRt: 基于音频视觉对象的XR声音交互
机构 * Google Mountain View CA USA(谷歌山景城) ; University of Michigan Ann Arbor MI USA(密歇根大学安 Arbor分校) ; Columbia University New York NY USA(哥伦比亚大学) ; Google San Francisco CA USA(谷歌旧金山)
AI总结 MoXaRt通过音频视觉线索分离交织声源,提升XR环境中的语音可懂度和社交参与度。