PixelPonder: Dynamic Patch Adaptation for Enhanced Multi-Conditional Text-to-Image Generation
PixelPonder: 动态补丁自适应增强多条件文本到图像生成
机构 * Fudan University(复旦大学) ; Tencent Youtu Lab(腾讯优图实验室) ; Western University(西澳大学) ; University of Chinese Academy of Sciences(中国科学院大学)
专题命中 可控生成 :image generation(title,abstract);text-to-image(title,abstract);diffusion(abstract);分类 cs.CV
AI总结 提出PixelPonder统一控制框架,通过补丁级自适应条件选择和时间感知控制注入机制,解决多条件文本到图像生成中结构失真和伪影问题,在保持文本语义一致性的同时提升空间对齐精度。