S$^2$Q-VDiT: Accurate Quantized Video Diffusion Transformer with Salient Data and Sparse Token Distillation
S$^2$Q-VDiT: 精确量化视频扩散变换器与显著数据和稀疏令牌蒸馏
Weilun Feng, Haotong Qin, Chuanguang Yang, Xiangqi Li, Han Yang, Yuqi Li, Zhulin An, Libo Huang, Michele Magno, Yongjun Xu
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
ETH Zürich(苏黎世联邦理工学院)
机构
*
School of Artificial Intelligence, Beijing Normal University, Beijing 100875, China(人工智能学院,北京师范大学,北京)
;
Institute of Artificial Intelligence and Future Networks, Beijing Normal University, Zhuhai 519087, China(人工智能与未来网络研究院,北京师范大学,珠海)
Generative Neural Video Compression via Video Diffusion Prior
基于视频扩散先验的生成神经视频压缩
Qi Mao, Hao Cheng, Tinghan Yang, Libiao Jin, Siwei Ma
机构
*
School of Information and Communication Engineering, Communication University of China(信息与通信工程学院,通信大学)
;
School of Computer Science, Peking University(计算机学院,北京大学)
JavisDiT: Joint Audio-Video Diffusion Transformer with Hierarchical Spatio-Temporal Prior Synchronization
JavisDiT:具有层次化时空先验同步的联合音频视频扩散变换器
Kai Liu, Wei Li, Lai Chen, Shengqiong Wu, Yanhao Zheng, Jiayi Ji, Fan Zhou, Jiebo Luo, Ziwei Liu, Hao Fei, Tat-Seng Chua
机构
*
Zhejiang University(浙江大学)
;
National University of Singapore(新加坡国立大学)
;
University of Science and Technology of China(中国科学技术大学)
;
University of Rochester(罗切斯特大学)
;
Nanyang Technological University(南洋理工大学)
Zero-Shot Video Restoration and Enhancement with Assistance of Video Diffusion Models
借助视频扩散模型的零样本视频修复与增强
Cong Cao, Huanjing Yue, Shangbin Xie, Xin Liu, Jingyu Yang
机构
*
School of Electrical and Information Engineering, Tianjin University(电子信息工程学院,天津大学)
;
Computer Vision and Pattern Recognition Laboratory, School of Engineering Science, Lappeenranta-Lahti University of Technology LUT(计算机视觉与模式识别实验室,工程科学学院,拉佩兰塔-拉赫蒂技术大学LUT)
Efficient Autoregressive Video Diffusion with Dummy Head
高效的自回归视频扩散模型与Dummy头
Hang Guo, Zhaoyang Jia, Jiahao Li, Bin Li, Yuanhao Cai, Jiangshan Wang, Yawei Li, Yan Lu
机构
*
Tsinghua University(清华大学)
;
Microsoft Research Asia(微软亚洲研究院)
;
Johns Hopkins University(约翰霍普金斯大学)
;
University of Science and Technology of China(中国科学技术大学)
ACD: Direct Conditional Control for Video Diffusion Models via Attention Supervision
ACD: 通过注意力监督实现视频扩散模型的直接条件控制
Weiqi Li, Zehao Zhang, Liang Lin, Guangrun Wang
机构
*
Sun Yat-sen University(中山大学)
;
Yonsei University(延世大学)
;
Guangdong Key Laboratory of Big Data Analysis and Processing(广东大数据分析与处理重点实验室)
;
X-Era AI Lab(X-Era人工智能实验室)
Video Signature: Implicit Watermarking for Video Diffusion Models
Yu Huang, Junhao Chen, Shuliang Liu, Hanqian Li, Jungang Li, Qi Zheng, Aiwei Liu, Yi R. Fung, Xuming Hu
机构
*
AI Thrust, Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)人工智能 thrust)
;
Hong Kong University of Science and Technology(香港科学与技术大学)
;
School of Software, BNRist, Tsinghua University(清华大学软件学院)