机构
*
Federal Institute for Occupational Safety and Health (BAuA)(联邦职业安全与健康研究所)
;
Fraunhofer Institute for Manufacturing Engineering and Automation IPA(弗劳恩霍夫研究所(制造工程与自动化IPA))
Think in Strokes, Not Pixels: Process-Driven Image Generation via Interleaved Reasoning
以笔触而非像素思考:通过交错推理实现过程驱动的图像生成
Lei Zhang, Junjiao Tian, Zhipeng Fan, Kunpeng Li, Jialiang Wang, Weifeng Chen, Markos Georgopoulos, Felix Juefei-Xu, Yuxiang Bao, Julian McAuley, Manling Li, Zecheng He
机构
*
Meta Superintelligence Labs(Meta超级智能实验室)
;
University of California, San Diego(加州大学圣迭戈分校)
;
Worcester Polytechnic Institute(伍斯特理工学院)
;
Northwestern University(西北大学)
机构
*
School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(科学与工程学院,香港中文大学(深圳))
;
Future Network of Intelligence Institute, CUHK-Shenzhen(智能网络研究院,CUHK-深圳)
RSGen: Enhancing Layout-Driven Remote Sensing Image Generation with Diverse Edge Guidance
RSGen: 通过多样边缘引导增强布局驱动的遥感图像生成
Xianbao Hou, Yonghao He, Zeyd Boukhers, John See, Hu Su, Wei Sui, Cong Yang
机构
*
School of Future Science and Engineering, Soochow University, Suzhou, China(未来科学与工程学院,苏州大学)
;
D-Robotics, Beijing, China(北京D-机器人)
;
Fraunhofer Institute for Applied Information Technology, Sankt Augustin, Germany(弗劳恩霍夫应用信息技术研究所)
;
School of Mathematical and Computing Sciences, Heriot-Watt University Malaysia, Putrajaya, Malaysia(数学与计算科学学院,赫瑞-瓦德大学马来西亚分校)
;
Institute of Automation, Chinese Academy of Sciences, Beijing, China(自动化研究所,中国科学院北京分院)
Dynamic Frequency Modulation for Controllable Text-driven Image Generation
动态频率调制用于可控的文本驱动图像生成
Tiandong Shi, Ling Zhao, Ji Qi, Jiayi Ma, Chengli Peng
机构
*
School of Geosciences and Info-Physics of Central South University(中南大学地球科学与信息物理学院)
;
School of Geography and Remote Sensing(地理科学与遥感学院)
;
Electronic Information School(电子信息学院)
;
School of Robotics(机器人学院)
POCI-Diff: Position Objects Consistently and Interactively with 3D-Layout Guided Diffusion
POCI-Diff: 通过3D布局引导扩散实现位置对象一致性和交互
Andrea Rigo, Luca Stornaiuolo, Weijie Wang, Mauro Martino, Bruno Lepri, Nicu Sebe
机构
*
DISI, University of Trento(DISI,特伦托大学)
;
Toretei S.r.l.(Toretei公司)
;
Visual AI Lab, MIT-IBM Watson AI Lab(视觉人工智能实验室,MIT-IBM沃森人工智能实验室)
;
Fondazione Bruno Kessler(布鲁诺·凯斯勒基金会)
SafeRedir: Prompt Embedding Redirection for Robust Unlearning in Image Generation Models
SafeRedir: 基于提示嵌入重定向的图像生成模型鲁棒去学习
Renyang Liu, Kangjie Chen, Han Qiu, Jie Zhang, Kwok-Yan Lam, Tianwei Zhang, See-Kiong Ng
机构
*
National University of Singapore(国立新加坡大学)
;
Nanyang Technological University(南洋理工大学)
;
Tsinghua University(清华大学)
;
CFAR and IHPC, A*STAR(CFAR和IHPC,A*STAR)
MoGen: A Unified Collaborative Framework for Controllable Multi-Object Image Generation
MoGen:一种用于可控多对象图像生成的统一协作框架
Yanfeng Li, Yue Sun, Keren Fu, Sio-Kei Im, Xiaoming Liu, Guangtao Zhai, Xiaohong Liu, Tao Tan
机构
*
Faculty of Applied Sciences, Macao Polytechnic University(澳门理工学院)
;
College of Computer Science, Sichuan University(四川大学计算机学院)
;
Department of Computer Science and Engineering, Michigan State University(密歇根州立大学计算机科学与工程系)
;
School of Information Science and Electronic Engineering, Shanghai Jiao Tong University(上海交通大学信息科学与电子工程学院)
;
School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院)
机构
*
Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳))
;
City University of Hong Kong, Hong Kong, China(香港城市大学)
;
Peking University, Beijing, China(北京大学)
;
Tsinghua University, Beijing, China(清华大学)