Refining Few-Step Text-to-Multiview Diffusion via Reinforcement Learning
通过强化学习细化少步文本到多视图扩散模型
Ziyi Zhang, Li Shen, Deheng Ye, Yong Luo, Huangxuan Zhao, Meng Liu, Wei Yu, Lefei Zhang
机构
*
School of Computer Science, National Engineering Research Center for Multimedia Software and Hubei Key Laboratory of Multimedia and Network Communication Engineering, Wuhan University(计算机学院、多媒体软件国家工程研究中心和湖北多媒体与网络通信工程重点实验室、武汉大学)
;
School of Cyber Science and Technology, Shenzhen Campus of Sun Yat-sen University(中山大学信息科学与技术学院深圳校区)
;
Tencent Inc.(腾讯公司)
;
Xiaomi Inc., China(小米公司,中国)
DyWeight: Dynamic Gradient Weighting for Few-Step Diffusion Sampling
DyWeight: 动态梯度加权用于少步扩散采样
Tong Zhao, Mingkun Lei, Liangyu Yuan, Yanming Yang, Chenxi Song, Yang Wang, Beier Zhu, Chi Zhang
机构
*
Zhejiang University(浙江大学)
;
AGI Lab, Westlake University(西湖大学AGI实验室)
;
TongJi University(同济大学)
;
University of Science and Technology of China(中国科学技术大学)
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
ETH Zürich(苏黎世联邦理工学院)
;
City College of New York, City University of New York, USA(纽约城市学院,纽约城市大学,美国)
;
Shanghai Jiao Tong University(上海交通大学)
S$^2$Q-VDiT: Accurate Quantized Video Diffusion Transformer with Salient Data and Sparse Token Distillation
S$^2$Q-VDiT: 精确量化视频扩散变换器与显著数据和稀疏令牌蒸馏
Weilun Feng, Haotong Qin, Chuanguang Yang, Xiangqi Li, Han Yang, Yuqi Li, Zhulin An, Libo Huang, Michele Magno, Yongjun Xu
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
ETH Zürich(苏黎世联邦理工学院)
On the Design of One-step Diffusion via Shortcutting Flow Paths
关于通过捷径流路径设计一步扩散模型
Haitao Lin, Peiyan Hu, Minsi Ren, Zhifeng Gao, Zhi-Ming Ma, Guolin ke, Tailin Wu, Stan Z. Li
机构
*
Department of Artificial Intelligence, School of Engineering, Westlake University(人工智能系,工程学院,西湖大学)
;
Academy of Mathematics and Systems Science, Chinese Academy of Sciences(数学与系统科学学院,中国科学院)
;
DP Technology, Beijing(北京DP技术)
F-scheduler: illuminating the free-lunch design space for fast sampling of diffusion models
F-scheduler: 探索扩散模型快速采样中的免费午餐设计空间
Zilai Li, Lujia Bai
机构
*
Department of Mathematics, at Ruhr University Bochum in the group of Holger Dette, Germany(鲁尔大学博德姆数学系)
;
Independent Researcher, Guangdong, China(独立研究者)
机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所)
;
School of Information and Electronic Engineering, Shandong Technology and Business University(山东科技职业大学信息与电子工程学院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
PeopleAl, Inc.(PeopleAl公司)
;
School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)
;
Terminal Technology Department, Alipay, Ant Group(蚂蚁集团支付宝终端技术部)