机构
*
Tsinghua University(清华大学)
;
WeChat Vision, Tencent Inc.(腾讯公司微信视觉部门)
;
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
The University of Hong Kong(香港大学)
;
The Hong Kong Polytechnic University(香港理工大学)
SpatialVAM:Spatial-Aware Multi-View Video Diffusion as a Data-Efficient Robot Policy
多视角视频扩散策略:一种3D空间-时间感知的视频动作模型
Peiyan Li, Yixiang Chen, Yuan Xu, Jiabing Yang, Xiangnan Wu, Jun Guo, Nan Sun, Long Qian, Xinghang Li, Xin Xiao, Jing Liu, Nianfeng Liu, Tao Kong, Yan Huang, Liang Wang, Tieniu Tan
机构
*
New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别国家重点实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
FiveAges(五时代)
;
Tsinghua University(清华大学)
;
Xi’an Jiaotong University(西安交通大学)
;
Wuhan University(武汉大学)
;
Nanjing University(南京大学)