arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 2869 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 2193 篇

2607.21606 2026-07-27 cs.AI 新提交 85%

TILT: Improving Compositional Generation in Diffusion Models with a Model-Intrinsic Reward

TILT:使用模型内在奖励改进扩散模型中的组合生成

Debottam Dutta, Jaehoon Hahm, Jianchong Chen, Romit Roy Choudhury

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract)

AI总结 研究如何改进扩散模型的组合生成,提出无训练框架TILT,通过测试时奖励对齐,将组合失败解释为分布重叠模式并定义固有奖励,产生KL约束目标及指导步骤,实验表明该方法能在保图质时提升组合对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19919 2026-07-23 cs.RO cs.LG 新提交 85%

Diffusion ReRoll: Revisable Denoising for Robotic Sequential Prediction

扩散重滚动:用于机器人序列预测的可修正去噪

Seonsoo Kim, Seongil Hong, Jun-Gill Kang

机构 * Agency for Defense Development(国防发展局)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract)

AI总结 研究提出扩散重滚动框架用于机器人序列预测,能选择性重新去噪局部稳定区域,实现跨视野迭代修正。通过与其他方法对比评估,在多任务基准测试中取得更好性能,支持结构化重新去噪是可修正机器人序列生成的有效机制。

Comments Project Page: https://seonsoo-p1.github.io/DiffusionReRoll/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13955 2026-06-15 cs.LG 新提交 85%

Smoothing Dark Areas in Molecular Latent Diffusion

分子潜在扩散中的暗区平滑

Xi Wang, Jiahan Li, Yuxuan Xia, Yingcheng Wu, Shaoyi Zheng, Shengjie Wang

机构 * New York University(纽约大学) Stanford University(斯坦福大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);inpainting(abstract)

AI总结 针对分子潜在扩散中存在的暗区问题,提出拓扑优化VAE(TopVAE),通过训练时内化结构和化学约束,减少暗区,提升离后验鲁棒性,在QM9和GEOM-Drugs上取得显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01803 2026-07-07 cs.CV cs.GR cs.RO 新提交 84%

PixGS: Pixel-Space Diffusion for Direct 3D Gaussian Splat Generation

PixGS: 像素空间扩散用于直接三维高斯泼溅生成

Cao Duy, Phong Nguyen-Ha

机构 * Qualcomm AI Research(高通人工智能研究院)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV、cs.GR

AI总结 提出单阶段管道PixGS,利用像素空间扩散从文本或图像直接生成高质量3D高斯泼溅,避免潜在压缩伪影,并引入表面法线、深度和高频结构监督,在单张A100 GPU上1秒内生成,性能超越现有方法。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17432 2026-06-17 cs.GR cs.CV 新提交 84%

Edit3DGS: Unified Framework for Dynamic Head Editing via 2D Instruction-Guided Diffusion and 3D Gaussian Splatting

Edit3DGS:通过2D指令引导扩散与3D高斯泼溅的动态头部编辑统一框架

Duy-Dat Tran, Trung-Nghia Le

机构 * University of Science, VNU-HCM, Ho Chi Minh, Vietnam(越南胡志明市国家大学) Vietnam National University, Ho Chi Minh, Vietnam(越南国家大学)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV、cs.GR

AI总结 提出Edit3DGS统一框架,结合2D指令引导扩散与3D高斯泼溅,实现动态3D头部的可控编辑,支持表情变换、属性修改等操作,并保持身份与运动动态的一致性。

Comments SOICT 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10853 2026-07-14 cs.CV cs.LG 新提交 84%

Diversify Diffusion with Temperature Sampling and Variance-Corrective Time Shifting

通过温度采样和方差校正时间偏移实现扩散多样化

Peizhuo Li, Emre Aksan, Alexandru-Eugen Ichim, Thabo Beeler, Olga Sorkine-Hornung

机构 * ETH Zurich(苏黎世联邦理工学院) Google(谷歌)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 研究针对扩散模型难以达到罕见模式的问题,提出方差校正时间偏移方法,并结合温度采样,无需重新训练就能提升样本多样性,在多个模型中以低成本实现质量和保真度提升,还能实现从粗到细的控制。

Comments Webpage: https://peizhuoli.github.io/diversify-diffusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28489 2026-07-31 cs.IT math.IT 新提交 83%

Forecasting Land Art Under Climate Scenarios

气候情景下的大地艺术预测

Alev Cinbarci, Sean Kalaycioglu

专题命中 扩散模型 :diffusion(summary_cn,abstract);image synthesis(abstract)

AI总结 本文基于《螺旋防波堤》的遥感数据,构建两阶段预测流程,结合IPCC气候情景与Stable Diffusion XL模型,预测该大地艺术的图像复杂性及暴露状态,并探讨文化遗产伦理问题。

Comments 15 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13455 2026-08-14 cs.CV 新提交 83%

Evaluation of Clinically Steerable Retinal Image Generation from Foundation Model Latent Spaces

基于基础模型潜在空间的临床可操控视网膜图像生成评估

Zuzanna A. Wakefield-Skórniewska, Bartłomiej W. Papież

机构 * Nuffield Department of Population Health, University of Oxford(牛津大学纳菲尔德人口健康系) University of Oxford(牛津大学)

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 该研究评估了四种视网膜基础模型的可控图像生成能力,发现其在自身框架内生成的视网膜图像优于传统潜在扩散,但与真实图像存在表征差距,需进一步对齐。

Comments MICCAI 2026 Workshop SASHIMI Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13043 2026-08-14 cs.AI cs.CV cs.LG 新提交 83%

From Local Mismatch to Global Impact: Optimizing Cache Reuse Policy for Efficient Diffusion

从局部失配到全局影响:优化缓存重用策略以实现高效扩散模型

Xichen Ye, Yifan Wu, Zhikang Xie, Xiangyu Yue, Cheng Jin, Weizhong Zhang

机构 * Faculty of Engineering, The Chinese University of Hong Kong(香港中文大学工程学院) School of Data Science, Fudan University(复旦大学数据科学学院)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 针对扩散模型缓存策略与生成质量失配问题,提出GCache双层优化框架,在Wan2.1模型上实现2.17倍加速且LPIPS降至0.0316,性能优于现有缓存策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11807 2026-08-13 cs.CV 新提交 83%

CoDiR: Confidence-Guided Diffusion Refinement for Semi-Supervised Histopathology Segmentation

CoDiR:用于半监督组织病理学分割的置信度引导扩散精调

Hoai Nhan Pham, Dang-Nguyen Bui, Le-Van Thai, Thanh-Hiep Vo, Lan Anh Dinh Thi, Tien Dat Nguyen, Duy-Dong Nguyen, Ngoc Lam Quang Bui, Tam Tran, Zhi Huang

机构 * AI VIETNAM Lab(AI VIETNAM实验室) Portland Community College(波特兰社区学院) University of Science, VNU-HCM(胡志明市国家大学科学大学) Hanoi University of Science and Technology(河内科技大学) Jeonbuk National University(全北国立大学) Washington University School of Medicine(华盛顿大学医学院) Perelman School of Medicine, University of Pennsylvania(宾夕法尼亚大学佩雷尔曼医学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 针对半监督组织病理学分割的标注稀缺与伪标签不可靠问题,提出CoDiR框架,结合Mean Teacher与扩散模型精调伪标签,在GlaS、CRAG数据集上取得优异mDice指标,精调模块贡献显著

Comments Accepted to the MICCAI COMPAYL Workshop 2026 (11 pages, 2 figures, 6 tables)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10995 2026-08-12 cs.CV 新提交 83%

HNDiff: Haze-Noise Diffusion for Image Dehazing

HNDiff:用于图像去雾的雾霾-噪声扩散模型

Jin-Ting He, Fu-Jen Tsai, Yan-Tsung Peng, Min-Hung Chen, Chia-Wen Lin, Yen-Yu Lin

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学) National Tsing Hua University(国立清华大学) National Chengchi University(国立政治大学) NVIDIA(英伟达)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出嵌入大气散射模型的HNDiff扩散框架,通过雾霾感知噪声调度器关联正向退化物理机制,反向同步去雾去噪,改进主流去雾骨干网络并在基准数据集达最优结果。

Comments Accepted to ECCV 2026. Project Page: https://jin-ting-he.github.io/HNDiff

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07463 2026-08-10 cs.CV cs.LG 新提交 83%

MirrorWorld: Taming Video Diffusion Models for Mirror Reflection Generation

MirrorWorld:利用视频扩散模型生成镜像反射

Youjun Zhao, Alex Warren, Gary K. L. Tam, Rynson W. H. Lau

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

AI总结 MirrorWorld是一种反射感知视频修复框架,通过语义关系蒸馏和几何变换对齐建模场景与镜像的关系,在视频镜像反射重建任务上优于现有方法。

Comments Project Page: https://youjunzhao.github.io/MirrorWorld/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06794 2026-08-10 cs.CV 新提交 83%

PAST: Prompt-Adaptive Sampling Termination for Efficient Diffusion Model

PAST:用于高效扩散模型的提示自适应采样终止

Renye Yan, Jikang Cheng, You Wu, Wei Peng, Zongwei Wang, Ling Liang, Yimao Cai

机构 * Peking University(北京大学) Nanjing University(南京大学) Stanford University(斯坦福大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 PAST是一种提示自适应采样终止方法,通过双自适应协调机制提升扩散模型RL微调的计算效率与偏好优化质量,效率最高提升66.7%,质量最高提升29.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05878 2026-08-07 cs.CV 新提交 83%

MAVISEG: Manifold Propagation and Visual Prototypes for Zero-Shot Open-Vocabulary Segmentation in Diffusion Transformers

MAVISEG:用于扩散Transformer中零样本开放词汇分割的流形传播与视觉原型

Rajatsubhra Chakraborty, Xujun Che, Ritabrata Chakraborty, Xi Niu, Depeng Xu

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 MAVISEG是一种无需训练的优化层,通过恢复扩散Transformer的结构化信号,在六个基准测试的无需训练方法中取得了最强整体结果,其mIoU在各基准中均最优。

Comments 20 pages, 14 figures, 9 tables. Preprint under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04394 2026-08-06 cs.CV 新提交 83%

Free-Lunch Augmentation by Revisiting Diffusion-Based Data Generation for Cross-Domain Few-Shot Object Detection

通过重新审视基于扩散模型的跨域小样本目标检测数据生成实现无额外开销的数据增强

Zijian Zhuang, Yixiong Zou, Yuhua Li, Ruixuan Li

机构 * School of Computer Science and Technology, Huazhong University of Science and Technology(华中科技大学计算机科学与技术学院)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

AI总结 针对跨域小样本目标检测的域差距与数据稀缺挑战,提出带定制噪声的选择性修复(SITN)方法,结合定制噪声生成与选择性修复模块合成有效数据,在6个CDFSOD和4个CDFSS数据集上达到新的最先进性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01298 2026-08-04 cs.CV cs.AI cs.LG 新提交 83%

UDT: Reconciling U-Nets and Diffusion Transformers with Data-Adaptive Token Reduction

UDT:通过数据自适应令牌缩减协调U-Net与扩散Transformer

Junno Yun, Yaşar Utku Alçalar, Mehmet Akçakaya

机构 * University of Minnesota(明尼苏达大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 本研究提出UDT架构,通过数据自适应令牌合并协调U-Net与DiTs,在ImageNet图像生成任务中收敛速度更快、FID指标更优,为DiTs提供了新的高效骨干网络。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00444 2026-08-04 cs.CV 新提交 83%

Reconstruction-Shift Discrimination via Mask-Guided Latent Diffusion for Medical Anomaly Detection

基于掩码引导的潜在扩散的重构-偏移判别用于医学异常检测

Yibo Wan, Jinyu Cai, Yunhe Zhang, Yi Bin, See-kiong Ng

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 该研究提出判别式掩码引导扩散(DMD)框架,结合自监督分类的重构-偏移判别与残差定位,在五种医学影像数据集上实现了最优的无监督医学异常检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29337 2026-08-03 cs.CV cs.AI 新提交 83%

DualDiT: A Conditional Dual-Output Diffusion Transformer for Joint OCT Image and Segmentation Mask Generation

DualDiT:用于联合生成OCT图像与分割掩码的条件双输出扩散Transformer

Fernando García-Torres, Rocío del Amor, Sandra Morales, Álvaro Barroso, Peter Heiduschka, Björn Kemper, Valery Naranjo

机构 * Instituto Universitario de Investigación en Tecnología Centrada en el Ser Humano (HUMAN-tech), Universitat Politècnica de València(瓦伦西亚理工大学以人类为中心技术大学研究所) Artikode Intelligence S.L(Artikode智能公司) Biomedical Technology Center of the Medical Faculty, University of Muenster(明斯特大学医学院生物医学技术中心) Department of Ophthalmology, University of Muenster Medical Centre(明斯特大学医学中心眼科)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

AI总结 该研究提出DualDiT模型,联合生成小鼠OCT图像与分割掩码,在生成质量、下游分割性能上优于DDPM、LDM,可用于医学图像数据增强

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24249 2026-07-28 cs.CV cs.RO 新提交 83%

SILICA: Repurposing Diffusion Priors for Joint Glass Segmentation and Depth Estimation

SILICA:将扩散先验用于联合玻璃分割和深度估计

Tarun R, Anuj Verma, Laksh Nanwani, Sourav Garg, K. Madhava Krishna

机构 * Robotics Research Center (RRC), IIIT Hyderabad(海得拉巴国际信息技术研究所机器人研究中心)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 研究透明表面深度估计难题,提出SILICA统一管道,利用文本到图像扩散模型先验联合预测玻璃分割和深度,无需真实世界玻璃深度注释,经实验验证其在不同环境中零样本转移性能出色,优于现有模型。

Comments IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23937 2026-07-28 cs.CV 新提交 83%

Manifold-Constrained Noise Optimization for Diverse Diffusion Sampling

用于多样化扩散采样的流形约束噪声优化

Qitan Shi, Cheng Jin, Ziyuan Liu, Yuantao Gu

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 研究如何在推理时优化初始噪声以恢复几步蒸馏扩散模型的提示多样性。提出MoNO方法,在低维噪声流形上进行流形约束噪声优化,能大步长更新且无需辅助目标,实验表明该方法可保持图像质量并提升提示多样性。

Comments 19 pages, 14 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24110 2026-07-28 cs.CV cs.LG physics.optics 新提交 83%

BeyondFusion: Self-Aligned Latent Diffusion for Calibration-Free Infrared Super-Resolution and Infrared-Visible Fusion

超越融合:用于无校准红外超分辨率和红外-可见光融合的自对齐潜在扩散

Minchong Chen, Xiaoyun Yuan, Minyu Cao, Jianing Zhang, Jun Zhang, Shuyang Liu, Xiaokang Yang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 针对移动红外-可见光成像中跨传感器未对准问题,提出超越融合框架,通过引入跨模态自对齐模块及未对准增强模块,实现无校准条件下的红外超分辨率和红外-可见光融合,经实验验证了其有效性。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21591 2026-07-24 cs.CV 新提交 83%

Inference-Time Scaling of Diffusion Models via Progressive Seed Pruning

通过渐进式种子剪枝实现扩散模型的推理时间缩放

Rogerio Guimaraes, Pietro Perona

机构 * California Institute of Technology(加州理工学院)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 研究扩散模型推理时间缩放问题,提出渐进式种子剪枝方法,通过早期评估多种子并剪枝,有效利用固定计算预算,在扩散和流匹配主干上比其他基线方法在奖励引导选择及提示对齐评估上表现更优。

Comments Project page: https://www.vision.caltech.edu/psp. Code: https://github.com/rogerioagjr/psp

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19895 2026-07-23 cs.CV cs.AI 新提交 83%

OSVE: One Step Video Editing with One Step Diffusion Models

OSVE:使用单步扩散模型进行单步视频编辑

Habin Lim, Gyeong-Moon Park

机构 * Korea University(韩国大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 研究针对扩散模型文本引导视频编辑慢的问题,提出OSVE框架。通过训练可学习编码器预测初始噪声,引入UFE技术及滑动窗口策略保持一致性,实现高质量视频编辑,速度比现有方法快约155 - 171倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18882 2026-07-22 cs.CV cs.LG 新提交 83%

Local Label-Informed Feature Transfer for Generating Ground-Truth Medical Images: A Comparison of GAN- and Diffusion-Based Approaches

用于生成真实医学图像的局部标签信息特征转移:基于GAN和扩散方法的比较

Rick Wilming, Irem Ozseker, Luca Matteo Cornils, Ahcène Boubekki, Benedict Clark, Danny Panknin, Stefan Haufe

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

AI总结 研究针对医学成像中验证XAI方法缺少真实数据的问题,提出LLIFT框架,用GAN和扩散两种范式实现,能生成含真实病变的半合成脑磁共振图像,为评估XAI方法提供了可控真实数据,且评估效果良好。

Comments 6 pages, submitted to IEEE MetroXRAINE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18510 2026-07-22 cs.CV 新提交 83%

DuSPiT: Dual-Branch Sub-Patch Pixel Diffusion Transformer

DuSPiT:双分支子补丁像素扩散变换器

Yunpeng Bai, Yossi Gandelsman, Michaël Gharbi

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Reve(瑞夫)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 研究针对像素空间扩散中单一表示兼顾全局与细节的问题,提出双分支子补丁像素扩散变换器DuSPiT。通过分离全局与局部处理,利用两分支交互,实现更丰富细节和更好质量效率权衡,优于此前的像素空间扩散变换器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14765 2026-07-17 cs.CV 新提交 83%

Rare Concept Generation via Counterfactual Inference in Diffusion Models

通过扩散模型中的反事实推理生成罕见概念

Zhengyuan Jiang, Haipeng Liu, Meng Wang, Yang Wang

机构 * School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机与信息工程学院)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 针对扩散模型训练的常识偏差致罕见概念图像生成不佳的问题,提出基于反事实推理的CI-Diff方法,阻断干扰,利用自然直接效应解耦属性,重新设计引导机制,经实验验证该方法优于现有模型。

Comments Comments: 17 pages, 15 figures, to appear at ACM Multimedia 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13812 2026-07-16 eess.IV cs.CV 新提交 83%

TCAM-Diff: Triplane-Aware Cross-Attention Medical Diffusion Model

TCAM-Diff:三平面感知交叉注意力医学扩散模型

Zhenkai Zhang, Krista A. Ehinger, Tom Drummond

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 研究提出TCAM-Diff这一3D医学图像生成模型,采用仅解码器自动编码器方法学习三平面表示,利用三平面感知交叉注意力扩散模型整合特征,经预训练解码器模块转换为3D体素,在多规模医学数据集实验中结果出色,优于其他类似方法。

Comments Accepted at AAAI 2025. Code is available at https://github.com/Fredy-Zhang/TCAM-Diff

Journal ref Proceedings of the AAAI Conference on Artificial Intelligence, 39(21): 22732-22740, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09784 2026-07-14 cs.CV cs.IT math.IT 新提交 83%

Compression Asymmetry and Trajectory Binding in Noise-Anchored Diffusion Inversion

噪声锚定扩散反演中的压缩不对称性与轨迹绑定

Yongseong Park, Joeun Kim, HoEun Kim, Young-Sik Kim

机构 * DGIST(大邱庆北科学技术院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 研究真实图像扩散反演的质量-成本权衡,通过高斯噪声锚分离出压缩不对称与轨迹绑定机制,据此提出NARC方法,该方法无需训练,存储少且效果好,在实验中表现出色并可应用于其他模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05274 2026-07-07 cs.CV 新提交 83%

Erasing Without Collateral Damage: Precise Concept Removal in Diffusion Models

无附带损害擦除:扩散模型中的精确概念移除

Parth Upman, Nishita Jain, Shreyank N Gowda

机构 * School of Computer Science, University of Nottingham(诺丁汉大学计算机科学学院) Department of Computing, Imperial College London(伦敦帝国理工学院计算系)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 针对无训练概念擦除易损害相关非目标概念的问题,提出CARE闭式算子,在交叉注意力值空间实现精确擦除,无模型微调,可更好保留非目标概念。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04801 2026-07-07 cs.CV 新提交 83%

LILAC: Layer-Wise Independent LoRAs and Cascaded Conditioning for Multi-Concept Customization of Diffusion Models

LILAC:用于扩散模型多概念定制的分层独立LoRAs和级联条件处理

Marian Lupascu, Sebastian Ripa, Mihai Trascau, Mariana-Iuliana Georgescu, Ionut Mironica

机构 * Adobe Research, Romania(罗马尼亚Adobe研究院) Department of Computer Science, University of Bucharest, Romania(罗马尼亚布加勒斯特大学计算机科学系) International Computer High School of Bucharest, Romania(罗马尼亚布加勒斯特国际计算机高中)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 研究个性化文本到图像扩散模型渲染特定主题的难题,提出LILAC框架,通过分层独立训练低秩适配器并级联条件处理,避免参数干扰,无需联合训练,线性扩展且与主干无关,效果良好。

Comments 19 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏