SpatialVAM:Spatial-Aware Multi-View Video Diffusion as a Data-Efficient Robot Policy
多视角视频扩散策略:一种3D空间-时间感知的视频动作模型
Peiyan Li, Yixiang Chen, Yuan Xu, Jiabing Yang, Xiangnan Wu, Jun Guo, Nan Sun, Long Qian, Xinghang Li, Xin Xiao, Jing Liu, Nianfeng Liu, Tao Kong, Yan Huang, Liang Wang, Tieniu Tan
机构
*
New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别国家重点实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
FiveAges(五时代)
;
Tsinghua University(清华大学)
;
Xi’an Jiaotong University(西安交通大学)
;
Wuhan University(武汉大学)
;
Nanjing University(南京大学)
Exploring Sparsity for Parameter Efficient Fine Tuning Using Wavelets for Vision
探索用于视觉参数高效微调的小波稀疏性
Ahmet Bilican, M. Akın Yılmaz, A. Murat Tekalp, R. Gökberk Cinbiş
机构
*
Dept. of Electrical and Electronics Engineering, Koç University(电子工程系,科奇大学)
;
Codeway AI Research(Codeway人工智能研究)
;
Dept. of Computer Engineering, Middle East Technical University(计算机工程系,中东技术大学)