RichControl: Structure- and Appearance-Rich Training-Free Spatial Control for Text-to-Image Generation
RichControl: 面向文本到图像生成的、结构和外观丰富的免训练空间控制
机构 * Peking University(北京大学) ; Carnegie Mellon University(卡内基梅隆大学)
专题命中 可控生成 :text-to-image(title,abstract);image generation(title);diffusion(abstract);分类 cs.CV
AI总结 提出一种免训练框架,通过解耦条件特征的采样调度与去噪过程,并引入重启细化调度和外观丰富提示策略,在复杂条件下实现结构和外观平衡的受控生成。