SocialMirror: Reconstructing 3D Human Interaction Behaviors from Monocular Videos with Semantic and Geometric Guidance
SocialMirror: 从单目视频中利用语义和几何引导重建3D人体交互行为
机构 * ShanghaiTech University(上海科技大学) ; Nanyang Technological University(南洋理工大学) ; Guangzhou Institute of Energy Conversion, CAS(广州能源研究所,中国科学院) ; University of Science and Technology of China(中国科学技术大学) ; The Chinese University of Hong Kong(香港中文大学) ; Inceptio Technology(Inceptio科技) ; Shanghai Jiao Tong University(上海交通大学)
专题命中 其他VLM :vision-language model(abstract);分类 cs.CV
AI总结 本文提出SocialMirror框架,通过语义和几何引导解决单目视频中人体重建的挑战,实现高精度交互行为重建,展现强大的泛化能力。