CommentsAccepted to Ars Electronica EXPANDED 2026 - Conference on Animation and Interactive Art (in cooperation with ACM SIGGRAPH), Ars Electronica Festival, Linz. 7 pages, 7 figures. Authors' version
机构
*
MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS部)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Meituan(美团)
;
The Hong Kong Polytechnic University(香港理工大学)
;
CAIR, HKISI, CAS(中国科学院CAS HKISI CAIR)
DIVE: Inverting Conditional Diffusion Models for Discriminative Tasks
Yinqi Li, Hong Chang, Ruibing Hou, Shiguang Shan, Xilin Chen
机构
*
Key Laboratory of Intelligent Information Processing, Institute of Computing Technology, Chinese Academy of Sciences, Beijing, 100190, China, and University of Chinese Academy of Sciences, Beijing 100049, China(中国科学院信息处理重点实验室,计算技术研究所,北京,100190,中国,以及中国科学院大学,北京100049,中国)
Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation
Lijun Yu, José Lezama, Nitesh B. Gundavarapu, Luca Versari, Kihyuk Sohn, David Minnen, Yong Cheng, Vighnesh Birodkar, Agrim Gupta, Xiuye Gu, Alexander G. Hauptmann, Boqing Gong, Ming-Hsuan Yang, Irfan Essa, David A. Ross, Lu Jiang
机构
*
State Key Lab of CAD&CG, Zhejiang University(浙江大学CAD&CG国家重点实验室)
;
Robbyant
;
Chinese University of Hong Kong(香港中文大学)
;
Ant Group(蚂蚁集团)
;
Hong Kong University of Science and Technology(香港科技大学)