arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1299 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 1299 篇

2607.06714 2026-07-24 math.ST stat.TH 版本更新 71%

Expectation-Maximization algorithm to estimate the forcing parameter of a nonlinear McKean-Vlasov diffusion

用于估计非线性McKean-Vlasov扩散强迫参数的期望最大化算法

Eduardo Gutierrez-Turner, Kerlyns Martinez, Hector Olivero

专题命中 扩散模型 :diffusion(title)

AI总结 研究受瞬时湍动能模型启发的随机微分方程中强迫参数估计问题,基于期望最大化框架提出估计算法,证明其一致性并通过数值实验说明发现。

Comments 24 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21518 2026-07-23 quant-ph 版本更新 71%

Momentum Diffusion, Decoherence and Drag Force on a Magnetic Nanoparticle

动量扩散、退相干与磁性纳米粒子的拖力

Agya Sewara Alam, Anupam Mazumdar

专题命中 扩散模型 :diffusion(title)

AI总结 本文研究了磁性纳米粒子在量子叠加态下受波动电磁场影响的退相干率及拖力来源,通过长波极限下的涨落-耗散定理进行推导并与其他性质进行比较。

Comments 28 pages, includes appendices, no figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07291 2026-07-21 cond-mat.mtrl-sci 版本更新 71%

Hydrogen Bond Strength Dictates the Rate-Limiting Steps of Diffusion in Proton-Conducting Perovskites:A Critical Length Perspective

氢键强度决定质子传导钙钛矿中扩散的限速步骤:临界长度视角

Hang Ma, Jiajun Linghu, Nannan Han, Peng Feng, Yuling Zhuo, Ying Liang, Kunde Yang, Tianxing Ma, Zhi-Peng Li

专题命中 扩散模型 :diffusion(title)

AI总结 研究质子传导钙钛矿中质子迁移限速步骤,通过定量分解旋转和转移势垒提出氢键长度标准,能判断不同结构材料中质子旋转与转移速率,为质子传导电解质优化设计提供原子尺度见解。

Comments 11 Figures with a Supplemental Material

Journal ref Chem. Mater. 38, 6069(2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03758 2026-07-14 cs.LG cs.NA math.NA 版本更新 71%

A Data-Driven Interpolation Method on Smooth Manifolds via Diffusion Processes and Voronoi Tessellations

基于扩散过程与沃罗诺伊细分的光滑流形上数据驱动的插值方法

Alvaro Almeida Gomez

机构 * Universidad de Chile(智利大学)

专题命中 扩散模型 :diffusion(title)

AI总结 本文提出一种基于拉普拉斯-贝尔特拉米算子和沃罗诺伊细分的数据驱动插值方法,通过扩散过程和数据内在几何构造连续扩展,实现高效插值并提升可扩展性。

Comments Comments are welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21586 2026-07-09 physics.chem-ph cond-mat.stat-mech math-ph math.MP physics.bio-ph 版本更新 71%

Reaction-Diffusion Processes with Surface Autocatalysis

表面上的诞生、死亡与复制:自催化动力学的普适定律

Denis S. Grebenkov

专题命中 扩散模型 :diffusion(title)

AI总结 本文提出一个通用理论框架,通过非线性积分方程和Fokker-Planck方程描述表面介导的自催化过程,揭示损失与复制竞争导致的种群动态、普适标度律及灭绝或爆发条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01894 2026-07-09 cs.LG 版本更新 71%

Bifidelity Parameter Estimation Using Conditional Diffusion Models

使用条件扩散模型的双保真参数估计

Caroline Tatsuoka, Minglei Yang, Dongbin Xiu, Guannan Zhang

机构 * UT-Battelle, LLC(UT-巴特勒公司) US Department of Energy(美国能源部) The Ohio State University(俄亥俄州立大学) Oak Ridge National Laboratory(橡树岭国家实验室) Oak Ridge(橡树岭) Computer Science and Mathematics Division(计算机科学与数学 division)

专题命中 扩散模型 :diffusion(title)

AI总结 针对复杂系统参数估计不确定性量化,提出双保真方法。先构建低保真条件生成模型,特定情况时用其细化采样空间,再训练高保真无条件生成模型,经数值示例和实际应用验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19301 2026-07-08 math.PR 版本更新 71%

A Feynman--Kac representation of a non-conservative and path-dependent nonlinear reaction-diffusion-advection system

非保守且路径依赖的非线性反应扩散对流系统的费曼 - 卡茨表示

Daniela Morale, Leonardo Tarquini, Stefania Ugolini

专题命中 扩散模型 :diffusion(title)

AI总结 研究非保守且路径依赖的非线性反应扩散对流系统,通过给出概率解释,得到耦合随机公式并证明其适定性,引入相互作用粒子系统,表明加权后的经验测度收敛到极限次概率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15161 2026-07-07 nlin.PS 版本更新 71%

Localized spatiotemporal reaction-diffusion patterns on a line and a disk arising from a subcritical finite wavenumber Hopf instability

线和盘上由亚临界有限波数霍普夫不稳定性产生的局部化时空反应扩散模式

Edgar Knobloch, Saar O. Modai, Hannes Uecker, Arik Yochelis

专题命中 扩散模型 :diffusion(title)

AI总结 研究亚临界有限波数霍普夫分岔与Purwins模型中的时空局部化和扩展结构,通过数值持续方法分析线上的局部稳态和行进波的蛇形行为,并用弱非线性理论验证结果,揭示跳跃振子的起源及非典型同宿蛇形结构的组织。

Comments 40 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04015 2026-07-03 cs.DL 版本更新 71%

Examining persistence of European open repository infrastructure and its diffusion in the scholarly record

欧洲开放仓储基础设施的持久性及其在学术记录中的扩散研究

George Macgregor, Joy Davidson

专题命中 扩散模型 :diffusion(title)

AI总结 通过整合仓储注册数据和网络抓取信息,评估欧洲仓储的持久性,发现超过20%的仓储已“死亡”,约1.2万篇学术作品引用了无法检索的仓储内容,并提出了政策干预建议。

Comments 31 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13922 2026-06-29 math.AP math-ph math.MP physics.plasm-ph 版本更新 71%

Existence and Smoothing Effects for a Degenerate Diffusion from Plasma Instability Theory

等离子体不稳定性理论中退化扩散的存在性与光滑化效应

William Porteous, Irene M. Gamba, Kun Huang

专题命中 扩散模型 :diffusion(title)

AI总结 针对半线上由等离子体波准线性理论导出的退化抛物方程,在加权L^p初值和有界强迫项下证明弱解的存在性,并利用Bénilan-Crandall不等式揭示解的正时间光滑化机制,包括空间Hölder连续性和局部Lipschitz性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17002 2026-06-25 cond-mat.str-el 版本更新 71%

Electronic Sound and Diffusion in Disordered Multiband Metals

无序多带金属中的电子声与扩散

Miguel-Ángel Sánchez-Martínez, Blaise Goutéraux, Louk Rademaker, Felix Flicker

专题命中 扩散模型 :diffusion(title)

AI总结 研究无序多带金属中声学等离激元(恶魔)的动力学,发现无序导致模式频率变为纯虚数,产生扩散行为,解释了Sr₂RuO₄中恶魔的异常非线性色散。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07704 2026-06-17 math.PR 版本更新 71%

A note on the $\mathcal{W}_2$-convergence rate of the empirical measure of an ergodic $\mathbb{R}^d$-valued diffusion

关于遍历 $\mathbb{R}^d$ 值扩散过程经验测度的 $\mathcal{W}_2$ 收敛速率的一个注记

Jean-Francois Chassagneux, Gilles Pagès

专题命中 扩散模型 :diffusion(title)

AI总结 在强汇合和Lipschitz连续系数假设下,研究遍历扩散过程经验测度在Wasserstein距离下的均方和几乎必然收敛速率。

Comments This is a companion paper to arXiv preprint arXiv:2406.13370

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02711 2026-08-14 cs.CV 版本更新 70%

Hunyuan3D-Buffalo 1.0: A Unified Multimodal Model for Scalable 3D Generation, Understanding, and Editing

Hunyuan3D-Buffalo 1.0:用于可扩展3D生成、理解与编辑的统一多模态模型

Junliang Ye, Kenkun Liu, Guocun Wang, Yang Li, Yansong Qu, Chunshi Wang, Jingwei Xu, Yunhan Yang, Zibo Zhao, Jiachen Xu, Jiaao Yu, Lifu Wang, Zhihao Liang, Xin Huang, Zhuo Chen, Chunchao Guo

机构 * Tencent Hunyuan(腾讯混元)

专题命中 扩散模型 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 Hunyuan3D-Buffalo 1.0是支持3D理解、文本到3D生成等功能的统一多模态模型,构建87M规模语料库训练,在相关基准上达SOTA或领先性能,验证了统一训练的有效性。

Comments Project Page: https://tencent-hunyuan.github.io/Hunyuan3D-Buffalo1.0

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23688 2026-08-12 cs.CV 版本更新 70%

Do Protective Perturbations Really Protect Portrait Privacy under Real-world Image Transformations?

保护性扰动在现实世界图像变换下是否真的能保护肖像隐私?

Ruiqing Sun, Xingshan Yao, Zhijing Wu, Tian Lan, Chenhao Cui, Huiyang Zhao, Jialing Shi, Chen Yang, Xianling Mao

机构 * Beijing Institute of Technology(北京理工大学)

专题命中 扩散模型 :diffusion(abstract);image editing(abstract);分类 cs.CV

AI总结 本文评估了现实世界图像变换对基于像素扰动的主动防御方法的影响,发现其有效性受挑战,并提出净化框架以去除保护性扰动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05811 2026-08-10 cs.CV 版本更新 70%

Energy-Guided Flow Matching

能量引导的流匹配(Energy-Guided Flow Matching)

Haoyang Tong, Yu He, Fang Li, Lichen Ma, Jingling Fu, Dong Chen, Zhen Chen, Junshi Huang, Jie Cao

专题命中 扩散模型 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出能量引导的流匹配(EG-FM),通过移动端点显式建模从粗到细的生成轨迹,无需额外适配,在ImageNet类条件图像生成及文本到图像生成任务中均取得优异性能。

Comments 19 pages, Code:https://github.com/ysng123/EG-FM

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01591 2026-08-07 cs.CV 版本更新 70%

Faster and Better Alignment for Flow Matching Models via Step-aware Advantages

Know Your Step: 通过步感知优势实现更快速和更优的流匹配模型对齐

Zhixiong Yue, Feiyang Ye, Zixuan Ni, Sheng Shen, Yu Zhang

机构 * Zhejiang University(浙江大学) HiThink Research(HiThink研究) Southern University of Science and Technology(南方科技大学)

专题命中 扩散模型 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 TAFS GRPO通过步感知优势机制改进流匹配模型,实现更高效且更优的少步文本到图像生成与人类偏好对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01127 2026-08-05 cs.CV 版本更新 70%

MiniWorld: Democratizing the Training of Video World Models from Scratch

MiniWorld:从零开始普及视频世界模型的训练

Yian Zhao, Ruochong Zheng, Hongcan Guo, Yu Yan, Jian Zhang, Jie Chen

机构 * Peking University(北京大学)

专题命中 扩散模型 :diffusion(abstract,abstract_cn);分类 cs.CV

AI总结 MiniWorld是从零开始训练流式视频世界模型的可复现框架,采用特定模型与训练策略,可在单台8-GPU服务器数天内完成训练,旨在降低训练门槛以推动相关研究。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12753 2026-07-31 cs.CV 版本更新 70%

RFMSR: Residual Flow Matching for Image Super-Resolution

RFMSR:用于图像超分辨率的残差流匹配

Shuwei Huang, Tianyao Luo, Jicheng Liu, Pan Zhou

机构 * Huazhong University of Science and Technology(华中科技大学) Wuhan University(武汉大学)

专题命中 扩散模型 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 研究针对图像超分辨率,提出残差流匹配框架RFMSR,将源分布集中于LQ潜变量以减少传输距离并保留结构先验,采用两阶段训练策略,实验证明该方法相比SOTA实现了相当甚至更优的感知质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06020 2026-07-29 cs.CV 版本更新 70%

ReSAGE-PAR: Representational Similarity Assessment for Generative Expansion in Pedestrian Attribute Recognition

ReSAGE-PAR:行人属性识别中生成式扩展的表征相似性评估

Pablo Ayuso-Albizu, Pablo Carballeira, Juan C. SanMiguel, Paula Moral

机构 * Universidad Autónoma de Madrid(阿隆托纳大学马德里分校)

专题命中 扩散模型 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 针对行人属性识别数据稀缺问题,提出ReSAGE-PAR管道,通过扩散模型生成图像并利用贝叶斯分类器验证属性,实现可扩展的高保真数据集扩展,在标准骨干网络上提升高达8.7%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06757 2026-07-29 cs.CV 版本更新 70%

FlowInOne:Unifying Multimodal Generation as Image-in, Image-out Flow Matching

FlowInOne:将多模态生成统一为图像输入、图像输出的流匹配

Junchao Yi, Rui Zhao, Jiahao Tang, Weixian Lei, Linjie Li, Qisheng Su, Zhengyuan Yang, Lijuan Wang, Xiaofeng Zhu, Alex Jinpeng Wang

机构 * University of Electronic Science and Technology of China(电子科技大学) Central South University(中南大学) National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学) Microsoft(微软)

专题命中 扩散模型 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出FlowInOne框架,将多模态生成统一为纯视觉流匹配,通过视觉提示消除跨模态对齐瓶颈,实现文本到图像生成、布局引导编辑和视觉指令遵循的统一。

Comments Accepted by ECCV 2026. 38 Pages, 21 Figures, 12 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19632 2026-07-15 cs.CV 版本更新 70%

CreatiParser: Generative Image Parsing of Raster Graphic Designs into Editable Layers

CreatiParser: 从位图图形设计生成可编辑的图层

Weidong Chen, Dexiang Hong, Zhendong Mao, Yutao Cheng, Xinyan Liu, Lei Zhang, Yongdong Zhang

机构 * School of Information Science and Technology, University of Science and Technology of China(科学技术大学信息科学与技术学院) ByteDance Intelligent Creation(字节跳动智能创作) School of Computer Science and Technology, Harbin Institute of Technology (Weihai)(哈尔滨工业大学(威海)计算机科学与技术学院) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合国家科学中心人工智能研究院)

专题命中 扩散模型 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出CreatiParser框架,将位图图形设计分解为可编辑的文本、背景和贴纸图层,结合视觉语言模型和多分支扩散架构,提升生成质量与编辑灵活性,实验显示在Parser-40K和Crello数据集上性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23086 2026-07-13 cs.LG cs.CV 版本更新 70%

Policy-based Tuning of Autoregressive Image Models with Instance- and Distribution-Level Rewards

基于策略的自回归图像模型实例和分布级奖励调优

Orhun Bugra Baran, Melih Kandemir, Ramazan Gokberk Cinbis

机构 * Middle East Technical University (METU)(中东部技术大学) University of Southern Denmark(南部丹麦大学)

专题命中 扩散模型 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出一种轻量级强化学习框架,通过将基于标记的自回归合成视为马尔可夫决策过程,结合分布级LOO-FID奖励和实例级CLIP/HPSv2奖励,提升图像生成的质量和多样性。

Comments Accepted at the European Conference on Computer Vision (ECCV), 2026. This version includes the appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16920 2026-07-10 cs.CV 版本更新 70%

DeltaDeno: Zero-Shot Anomaly Generation via Delta-Denoising Attribution

DeltaDeno:通过Delta去噪归因实现零样本异常生成

Chaoran Xu, Chengkan Lv, Qiyu Chen, Yunkang Cao, Feng Zhang, Zhengtao Zhang

机构 * Institute of Automation, Chinese Academy of Sciences, Beijing, China(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences, Beijing, China(中国科学院大学人工智能学院) CASI Vision Technology CO., LTD., Luoyang, China(CASI视觉科技有限公司) School of Artificial Intelligence and Robotics, Hunan University, Changsha, China(湖南大学人工智能与机器人学院)

专题命中 扩散模型 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 研究在无真实异常样本和训练情况下的零样本异常生成问题,提出DeltaDeno方法,通过对比两个扩散分支定位编辑缺陷,累积去噪增量生成掩码,经令牌级提示细化等操作提升性能,在公共数据集实验中效果良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21556 2026-07-09 cs.CV 版本更新 70%

ECHO: Ego-Centric modeling of Human-Object interactions

ECHO:人类-物体交互的以自我为中心建模

Ilya A. Petrov, Vladimir Guzov, Riccardo Marin, Emre Aksan, Xu Chen, Daniel Cremers, Thabo Beeler, Gerard Pons-Moll

专题命中 扩散模型 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 ECHO首次提出统一框架,通过头和手腕追踪联合恢复人体姿态、物体运动和接触动力学,解决稀疏信号下的人类-物体交互建模难题。

Comments Accepted at ECCV'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31604 2026-07-07 cs.CV 版本更新 70%

Representation Forcing for Bottleneck-Free Unified Multimodal Models

表示强制:无瓶颈统一多模态模型

Yuqing Wang, Zhijie Lin, Ceyuan Yang, Yang Zhao, Fei Xiao, Hao He, Qi Zhao, Zihan Ding, Fuyun Wang, Shuai Wang, Youliang Zhang, Haoqi Fan, Xihui Liu

机构 * University of Hong Kong(香港大学) ByteDance Seed(字节跳动种子) The Chinese University of Hong Kong(香港中文大学) Nanjing University(南京大学) Tsinghua University(清华大学)

专题命中 扩散模型 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 提出表示强制(RF)技术,通过让解码器自回归预测视觉表示作为中间令牌,再在相同骨干网络中引导像素扩散,从而消除统一多模态模型对预训练VAE的依赖,实现无瓶颈的端到端模型。

Comments Project page: https://yuqingwang1029.github.io/RepresentationForcing

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16239 2026-07-07 cs.CV 版本更新 70%

EM3M: An Electron Micrograph Dataset for Microstructural Segmentation and Generation

EM3M:用于微观结构分割与生成的电子显微镜图像数据集

Nan Wang, Zhiyi Xia, Yiming Li, Siyuan Zhang, Shi Tang, Zuxin Fan, Xi Fang, Haoyi Tao, Guolin Ke, Yanhui Hong

机构 * DP Technology(DP技术)

专题命中 扩散模型 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 针对深度学习分析电子显微镜图像缺乏大规模专家标注数据集的问题,引入EM3M数据集,介绍构建过程,提供文本到图像扩散模型,评估分割方法并给出优化基线,推动自动化材料分析研究。

Comments 31 pages, 13 figures, Accepted by ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08305 2026-06-23 cs.CV cs.AI 版本更新 70%

Retrieval-Augmented Anatomical Guidance for Text-to-CT Generation

检索增强的解剖引导用于文本到CT生成

Daniele Molino, Camillo Maria Caruso, Paolo Soda, Valerio Guarrasi

机构 * Unit of Artificial Intelligence and Computer Systems, Department of Engineering, Università Campus Bio-Medico di Roma, Rome, Italy(人工智能与计算机系统单位,工程系,罗马生物医学大学,意大利罗马) Department of Diagnostics and Intervention, Biomedical Engineering and Radiation Physics, Umeå University, Umeå, Sweden(诊断与介入系,生物医学工程与放射物理,乌梅大学,瑞典乌梅)

专题命中 扩散模型 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 提出检索增强方法,通过检索相关临床案例的解剖标注作为结构代理,注入文本条件潜在扩散模型,实现文本到CT生成中语义与解剖信息的融合,提升图像保真度和临床一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24223 2026-06-16 cs.LG cs.CV stat.ML 版本更新 70%

Semantic Editing with Coupled Stochastic Differential Equations

耦合随机微分方程的语义编辑

Jianxin Zhang, Clayton Scott

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 扩散模型 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 提出耦合随机微分方程(coupled SDEs)引导预训练生成模型的采样过程,无需重新训练即可实现高提示保真度和近像素级一致性的语义编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12400 2026-06-15 math.CO cs.CV 版本更新 70%

Generation of Maximal Snake Polyominoes Using a Deep Neural Network

使用深度神经网络生成最大蛇形多联骨牌

Benjamin Gauthier, Alain Goupil, Fadel Toure

机构 * Université du Québec à Trois-Rivières(魁北克大学三河分校)

专题命中 扩散模型 :diffusion(abstract,abstract_cn);分类 cs.CV

AI总结 提出结构化像素空间扩散模型,从数据驱动学习生成最大蛇形多联骨牌,无需显式编码约束,能泛化到更大矩形并接近当前计算极限。

Comments In Proceedings GASCom 2026, arXiv:2606.09910

Journal ref EPTCS 445, 2026, pp. 104-113

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09630 2026-06-08 cs.GR 版本更新 70%

CASteer: Cross-Attention Steering for Controllable Concept Erasure

CASteer:跨注意力转向用于可控概念擦除

Tatiana Gaintseva, Andreea-Maria Oncescu, Chengcheng Ma, Ziquan Liu, Martin Benning, Gregory Slabaugh, Jiankang Deng, Ismail Elezi

专题命中 扩散模型 :image generation(abstract);diffusion(abstract);分类 cs.GR

AI总结 CASteer通过动态转向向量实现无需训练的扩散模型概念擦除,精准抑制无关概念而不影响整体图像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏