arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-07-31 至 2026-07-31 共收录 33 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1 篇

2509.21714 2026-07-31 cs.SD cs.MM 版本更新 70%

MusicWeaver: Programmable Long-Form Music Generation with Provably Local Editing

MusicWeaver: 作曲家风格的结构编辑与分钟级连贯音乐生成

Xuanchen Wang, Heng Wang, Weidong Cai

机构 * The University of Sydney(悉尼大学)

专题命中 图像编辑 :diffusion(abstract);inpainting(abstract);分类 cs.MM

AI总结 MusicWeaver通过结构化计划和全局-局部扩散变换器实现作曲家风格的音乐生成与编辑,具备分钟级连贯性和高保真度。

Comments 15 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 扩散模型 22 篇

2607.19139 2026-07-31 cs.CV 版本更新 83%

Text Template Tokens Are Implicit Semantic Registers in Diffusion Transformers

文本模板令牌是扩散Transformer中的隐式语义寄存器

Maohua Li, Qirui Li, Yanke Zhou, Yiduo Li, Zhaosheng Chi, Chao Xu, Cuifeng Shen, Yixuan Xu, Hanlin Tang, Kan Liu, Tao Lan, Lin Qu, Shao-Qun Zhang

机构 * Nanjing University(南京大学) Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

AI总结 研究文本到图像扩散Transformer中内部计算,引入因果可解释性框架,发现结构模板令牌充当隐式语义寄存器,据此设计剪枝规则,还揭示其生成计算组织方式,提供了DiTs内部机制的因果视图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23159 2026-07-31 cs.AI cs.CV cs.MM 版本更新 81%

CachedSearch: Training-Free Cached Exploration for Test-Time Search in Video Diffusion

CachedSearch:用于视频扩散测试时搜索的免训练缓存探索

Shreshth Saini, Neil Birkbeck, Yilin Wang, Balu Adsumilli, Alan C. Bovik

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV、cs.MM

AI总结 研究视频扩散测试时搜索中缓存对候选者排名的影响,提出CachedSearch方法,通过积极缓存探索候选者,仅全计算时重生成获胜者,在多模型多系列中有效提升效率,以低成本获高增益,且免训练、与验证器无关,可用于测试时扩展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24731 2026-07-31 cs.CV cs.AI cs.LG 版本更新 79%

Rethinking Classifier-Free Guidance in On-Policy Diffusion Distillation

重新思考策略性扩散蒸馏中的无分类器引导

Bingnan Li, Haozhe Wang, Haozhong Xiong, Fangtai Wu, Jinpeng Yu, Yang Shi, Jiaming Liu, Ruihua Huang

机构 * Qwen Business Unit of Alibaba(阿里巴巴的通义千问业务部)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 研究策略性扩散蒸馏在无分类器引导下的表现,指出现有方法存在负分支不对称问题,引入正向匹配方法,通过分支感知分别约束正预测和条件方向,应用于视频控制实现更有效知识转移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27075 2026-07-31 cs.CV 版本更新 79%

BeCARE: Budgeted Cache Refresh for Diffusion Transformer Acceleration

SoftCap: 扩散Transformer加速的软预算控制

Yuhang Zhang, Junxiang Qiu, Huixia Ben, Zhenhua Tang, Lin Liu, Shuo Wang, Yanbin Hao

机构 * Hefei University of Technology(合肥工业大学) University of Science and Technology of China(中国科学技术大学) Anhui University of Science and Technology(安徽理工大学) University of Macau(澳门大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出一种无需训练的软预算控制层SoftCap,通过轨迹漂移观测器和软预算PI控制器动态调整全步触发阈值,在保持计算预算软上限的同时提升图像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18801 2026-07-31 cs.CV 版本更新 79%

PartDiffuser: Part-wise 3D Mesh Generation via Discrete Diffusion

PartDiffuser:通过离散扩散实现部件级3D网格生成

Yichen Yang, Hong Li, Haodong Zhu, Linin Yang, Guojun Lei, Sheng Xu, Baochang Zhang

机构 * Beihang University(北航) Communication University of China(中国通信大学) Zhejiang University(浙江大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 PartDiffuser提出一种半自回归扩散框架,通过部件级方法生成高保真3D网格,有效平衡全局结构与局部细节。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11325 2026-07-31 cs.CV 版本更新 79%

ReDiff: Reliability-Guided Diffusion for Trustworthy Ultra-Low-Field to High-Field MRI Synthesis

迈向可信的选择性生成:用于超低场到高场MRI合成的可靠性引导扩散

Zhenxuan Zhang, Peiyuan Jing, Ruicheng Yuan, Liwei Hu, Anbang Wang, Fanwen Wang, Yinzhe Wu, Kh Tohidul Islam, Zhaolin Chen, Zi Wang, Peter Lally, Guang Yang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出ReDiff框架,通过可靠性引导的采样策略和多候选选择方案,提升MRI合成的鲁棒性和解剖学一致性,减少伪影并提高结构保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21628 2026-07-31 cs.AI eess.IV 版本更新 79%

Wavelet Phase Diffusion for Structurally and Semantically Consistent Sim-to-Real Translation

用于结构和语义一致的模拟到真实翻译的小波相位扩散

Kaiwen Wang, Frank Bieder, Yinzhe Shen, Carlos Fernandez, Jan-Hendrik Pauls, Omer Sahin Tas

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 研究模拟到真实翻译中弥合合成与真实域外观差距并保持结构语义一致的问题,提出小波相位扩散方法,通过双树复小波包变换域操作及低频随机化,在未配对数据训练,提升了图像和视频翻译的真实感与一致性。

Comments Project Page: https://kit-mrt.github.io/Wavelet-Phase-Diffusion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18997 2026-07-31 cs.LG 版本更新 78%

DIPHINE: Diffusion-based $Φ$-ID Neural Estimator

DIPHINE: 基于扩散的 $\Phi$ID 神经估计器

Simon Pedro Galeano Munoz, Mustapha Bounoua, Giulio Franzese, Pietro Michiardi, Maurizio Filippone

机构 * KAUST(卡塔尔科学与技术部) EURECOM(欧雷康)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出首个基于扩散模型的神经估计器 DIPHINE,用于计算连续非高斯动力系统的集成信息分解($\Phi$ID),通过单个摊销网络联合估计所有互信息项,并利用 Möbius 逆变换恢复十六个原子。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05117 2026-07-31 cs.RO 版本更新 78%

SeedPolicy: Horizon Scaling via Self-Evolving Diffusion Policy for Robot Manipulation

SeedPolicy: 通过自进化扩散策略实现机器人操控的水平扩展

Youqiang Gui, Yuxuan Zhou, Shen Cheng, Xinyang Yuan, Haoqiang Fan, Peng Cheng, Shuaicheng Liu

机构 * Sichuan University(四川大学) Dexmal Inc.(Dexmal公司) Independent Researcher(独立研究员) UESTC

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出SEGA模块,通过门控注意力机制提升扩散策略在长时域操控中的表现,实验表明其在RoboTwin 2.0基准上优于现有方法,具有更高的效率和性能。

Comments 17 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13707 2026-07-31 cs.RO cs.AI cs.LG 版本更新 78%

REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning

REFINE-DP:通过强化学习实现人形机器人的动态-操作协调政策微调

Zhaoyuan Gu, Yipu Chen, Zimeng Chai, Alfred Cueva, Thong Nguyen, Yifan Wu, Huishu Xue, Minji Kim, Isaac Legene, Fukang Liu, KyoungMok Kim, Ayan Barula, Yongxin Chen, Ye Zhao

机构 * The Institute for Robotics and Intelligent Machines(机器人与智能机械研究所)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出REFINE-DP框架,通过联合优化扩散政策高层规划器和基于强化学习的低层动态-操作控制器,提升人形机器人在复杂环境中的任务成功率与执行稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24974 2026-07-31 physics.chem-ph 版本更新 71%

Ultrafast configuration changes and anomalous diffusion of an aromatic adsorbate on rare-gas nanoparticles

芳香吸附质在稀有气体纳米颗粒上的超快构型变化与反常扩散

Arne Morlok, Philipp Elsässer, Yilin Li, Ulrich Bangert, Felix Riedel, Tanja Schilling, Frank Stienkemeier, Lukas Bruder

专题命中 扩散模型 :diffusion(title)

AI总结 研究稀有气体团簇上酞菁吸附质,结合高分辨率二维电子光谱和分子动力学模拟,揭示吸附质构型动力学,发现其亚扩散表面运动和捕获,为理解分子吸附质在纳米物体上的超快结合动力学提供见解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12753 2026-07-31 cs.CV 版本更新 70%

RFMSR: Residual Flow Matching for Image Super-Resolution

RFMSR:用于图像超分辨率的残差流匹配

Shuwei Huang, Tianyao Luo, Jicheng Liu, Pan Zhou

机构 * Huazhong University of Science and Technology(华中科技大学) Wuhan University(武汉大学)

专题命中 扩散模型 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 研究针对图像超分辨率,提出残差流匹配框架RFMSR,将源分布集中于LQ潜变量以减少传输距离并保留结构先验,采用两阶段训练策略,实验证明该方法相比SOTA实现了相当甚至更优的感知质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03661 2026-07-31 cs.LG cs.AI 版本更新 67%

Dynamically Scaled Activation Steering

动态缩放的激活引导

Alex Ferrando, Xavier Suau, Jordi Gonzàlez, Pau Rodriguez

机构 * Apple(苹果公司) Universitat Autònoma de Barcelona(巴塞罗那自治大学)

专题命中 扩散模型 :text-to-image(abstract);diffusion(abstract)

AI总结 DSAS是一种动态缩放的激活引导框架,通过自适应调节引导强度,在生成过程中实现对特定概念的调控,同时提升模型的可解释性和性能平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22241 2026-07-31 cs.CV 版本更新 57%

AgentHOI: Multi-Agent Reasoning for Human-Object-Interaction Video Generation via Implicit Representation Alignment

AgentHOI:通过隐式表示对齐进行人类-物体交互视频生成的多智能体推理

Ziyao Huang, Shunkai Li, Juan Cao, Chenyu Li, Youliang Zhang, Zixiang Zhou, Cong Wang, Yuan Zhou, Qinglin Lu, Fan Tang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Tencent HunYuan(腾讯混元)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 研究针对HOI视频生成中现有方法依赖显式运动控制的问题,提出AgentHOI,通过多智能体推理和隐式文本-运动对齐策略,实现文本驱动的HOI视频生成,提升了交互自然性等,改进了复杂场景下的表现。

Comments Under review. The code is available at https://github.com/bone-11/agenthoi

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08405 2026-07-31 cs.CV 版本更新 57%

SyncBreaker:Stage-Aware Multimodal Adversarial Attacks on Audio-Driven Talking Head Generation

SyncBreaker:面向音频驱动生成的多模态对抗攻击框架

Wenli Zhang, Xianglong Shi, Sirui Zhao, Xinqi Chen, Guo Cheng, Yifan Xu, Tong Xu, Yong Liao

机构 * University of Science and Technology of China(中国科学技术大学) Beijing University of Technology(北京工业大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 针对音频驱动生成中单模态防护不足的问题,提出SyncBreaker框架,通过多模态联合扰动提升防护效果,有效抑制唇同步和面部动态。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27011 2026-07-31 eess.AS 版本更新 50%

Qwen-Audio-3.0-Gen-Preview Technical Report

Qwen-Audio-3.0-Gen-Preview 技术报告

Junyu Dai, Xiaoyue Duan, Xinyue Fan, Yihan Feng, Jingbei Li, Xiangang Li, Yunjia Li, Lejun Min, Yufei Shi, Xingchen Song, Yiran Wang, Cheng Wen, Menglin Wu, Bajian Xiang, Huaicheng Zhang, Han Zhao, Ruichen Zheng

专题命中 扩散模型 :diffusion(abstract)

AI总结 针对现有音频系统难以组织多类型音频形成长时场景的问题,提出 Qwen-Audio-3.0-Gen-Preview 框架,采用 DiT 与共享 VAE 实现统一多域音频生成,在多个基准上展现出性能优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21721 2026-07-31 stat.ML cs.LG 版本更新 50%

Prior laundering: learned priors with inherited, undetectable overconfidence

先验清洗:具有继承性、不可检测的过度自信的学习先验

Ali Siahkoohi, Sina Alemohammad

机构 * Institute for Artificial Intelligence, University of Central Florida(人工智能研究所,中央佛罗里达大学) Department of CS, University of Central Florida(计算机科学系,中央佛罗里达大学) Department of ECE, The University of Texas at Austin(电子工程系,德克萨斯大学奥斯汀分校)

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究在贝叶斯逆问题中使用学习生成先验时因真值稀缺采用先验清洗的情况,指出其过度自信问题,通过对旧后验求平均产生旧正则化器,单个最佳档案更糟,部署时拟合档案的先验未覆盖盲子空间,建议分开数据支持置信度与继承信念。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06696 2026-07-31 stat.ML cs.LG stat.ME 版本更新 50%

Heat-Kernel Entropy Profiles and Geometric Effective Sample Size for Weighted Measures on Manifolds

流形上加权测度的热核熵剖面与几何有效样本量

Kisung You, Boram Cho

机构 * Baruch College(巴克尔学院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 研究紧致流形上加权测度,引入热核熵剖面这一多尺度总结方法,通过内在热流扩散加权原子并跟踪尺度不均匀性,可计算二阶Rényi熵的几何有效样本量,实验表明其能揭示传统总结遗漏的结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17186 2026-07-31 math.NA cs.NA math.DS math.PR q-bio.QM stat.CO 版本更新 50%

Operator splitting for exploiting linear-rate closure in solving infinite ODE hierarchies

利用闭合条件和算子分裂求解线性速率ODE层级(如同主方程)

Joshua C Chang

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种方法,通过闭合条件和算子分裂来求解线性速率ODE层级,解决了连续时间马尔可夫过程的正向方程问题,展示了该方法在不同应用中的有效性,包括分支过程、矩阵值电报和G/R延长等。

Comments An implementation exists at https://github.com/nih-niddk-mbs/StochasticGene.jl

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01110 2026-07-31 cs.RO 版本更新 50%

Compact Task-Aligned Imitation Learning for Laboratory Automation

紧凑的任务对齐模仿学习用于实验室自动化

Kanata Suzuki, Hanon Nakamura, Kana Miyamoto, Tetsuya Ogata

机构 * Spatial Robotics Research Center, Fujitsu Limited.(富士通株式会社空间机器人研究中心) Faculty of Science and Engineering, Waseda University(早稻田大学理工学部) National Institute of Advanced Industrial Science and Technology(国家工业科学与技术研究院)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文提出了一种紧凑的模仿学习框架,通过小基础模型和扩散变换器专家实现高效实验室自动化,实验显示其在三个任务中的高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26172 2026-07-31 cs.HC cs.AI cs.SI 版本更新 50%

Linking Heterogeneous Data with Coordinated Agent Flows for Social Media Analysis

通过协调智能体流关联异构数据以开展社交媒体分析

Shifu Chen, Dazhen Deng, Zhihong Xu, Sijia Xu, Linyu Qin, Tai-Quan Peng, Yingcai Wu

机构 * Zhejiang University(浙江大学) Department of Communication, Michigan State University(密歇根州立大学通讯系)

专题命中 扩散模型 :diffusion(abstract)

AI总结 本研究提出LLM智能体系统SIA,通过协调智能体流关联社交媒体异构多模态数据,采用阶段同步策略挖掘洞见,经评估可发现多样有意义的洞见,为社交媒体分析提供新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21365 2026-07-31 math.AP 版本更新 50%

Self-sustaining traveling fronts for a model related to bushfires

与丛林大火相关模型的自维持行波前

Serena Dipierro, Enrico Valdinoci, Glen Wheeler, Valentina-Mira Wheeler

专题命中 扩散模型 :diffusion(abstract)

AI总结 该研究针对丛林大火蔓延的数学模型,明确大火蔓延或熄灭的条件,发现垂直平移解不存在,而温和或短程核的任意速度行波解始终存在且剖面无界。

Comments 31 pages, 2 figures, accepted version (JDE)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 可控生成 4 篇

2511.19982 2026-07-31 cs.CV cs.AI 版本更新 74%

EmoFeedback$^2$: Reinforcement of Continuous Emotional Image Generation via LVLM-based Reward and Textual Feedback

EmoFeedback$^2$:基于LVLM的奖励与文本反馈的连续情绪图像生成强化

Kai Shu, Jingyang Jia, Gang Yang, Long Xing, Xun Chen, Aiping Liu

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 可控生成 :image generation(title);分类 cs.CV

AI总结 EmoFeedback$^2$通过基于LVLM的奖励与文本反馈机制,提升连续情绪图像生成的质量与情绪保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22718 2026-07-31 cs.CV 版本更新 57%

Generative Relightable Avatars

生成式可重光照虚拟化身

Kunwar Maheep Singh, Christian Theobalt, Rishabh Dabral

机构 * Max Planck Institute for Informatics, Saarland Informatics Campus(马克斯·普朗克信息学研究所,萨尔兰信息学园区)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 提出生成式可重光照虚拟化身(GRA),结合物理光照与概率细化,实现全身人物的自由视角渲染和环境图重光照,在感知质量上优于现有方法。

Comments Project Page: https://vcai.mpi-inf.mpg.de/projects/GRA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23969 2026-07-31 cs.RO 版本更新 50%

LeapBot-WA: World-Anchor Action Models via Predictive Latent Alignments

LeapBot-WA:通过预测性潜在对齐实现的世界锚定动作模型

Pei Liu, Nan Zheng, Lang Zhang, Daojie Peng, Yanan Zhang, Feilong Kong, Mingyue Feng, Jiachao Liu, Yaonong Wang, Qifeng Chen, Jun Ma

专题命中 可控生成 :diffusion(abstract)

AI总结 研究针对世界动作模型依赖像素级视频生成的瓶颈,提出LeapBot-WA,通过预测性潜在对齐建立新范式,引入ISAE弥合模态差距,设计MoT架构,在多数据集上表现出色,实现高效强大的潜在中心范式及零样本鲁棒性和现实世界迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18584 2026-07-31 cond-mat.mes-hall 版本更新 50%

Boundary condition for phonon distribution functions at a smooth crystal interface and interfacial angular momentum transfer

声子分布函数在光滑晶体界面处的边界条件及界面角动量转移

Yuta Suzuki, Shuntaro Sumita, Yusuke Kato

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出声子在光滑晶体界面处的边界条件,揭示了界面角动量转移机制,阐明了自旋角动量与轨道角动量在声子传输中的作用。

Comments Revised version. Main text (35 pages, 9 figures, 1 table) + supplementary material (4 pages, 2 figures, no tables). This manuscript provides a detailed analysis of an accompanying Letter (latest version of arXiv:2409.08874)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 图像修复 1 篇

2511.20722 2026-07-31 cs.CV cs.AI 版本更新 86%

DinoLizer: Separating VAE and Diffusion Artifacts in Generative Inpainting Localization

DinoLizer: 从最佳中学习以实现生成修复的定位

Minh Thong Doi, Vincent Itier, Jan Butora, Jérémie Boulanger, Patrick Bas

专题命中 图像修复 :inpainting(title,abstract);diffusion(title);分类 cs.CV

AI总结 DinoLizer基于DINOv2改进生成修复中的篡改定位,通过滑动窗口和后处理提升鲁棒性,实现更高的IoU性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 个性化与一致性 2 篇

2605.07861 2026-07-31 cs.CV 版本更新 57%

From Synthetic to Real: Toward Identity-Consistent Makeup Transfer with Synthetic and Real Data

从合成到真实:迈向身份一致的化妆转移的合成与真实数据

Yue Yu, Jiayu Wang, Jiajia Shi, Zhiyu Tan, Hao Li, Jingjing Chen

机构 * College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究院)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出ConsistentBeauty和RealBeauty方法,通过合成数据筛选和强化学习提升化妆转移的逼真度与身份一致性,并建立多样化基准测试以评估模型在复杂真实场景中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13349 2026-07-31 cs.CV cs.AI 版本更新 57%

ID-Guard: A Universal Framework for Combating Facial Manipulation via Breaking Identification

ID-Guard:一种通过破坏身份特征来对抗面部操纵的通用框架

Zuomin Qu, Wei Lu, Xiangyang Luo, Qian Wang, Xiaochun Cao

专题命中 个性化与一致性 :inpainting(abstract);分类 cs.CV

AI总结 本研究针对面部操纵滥用的问题,提出ID-Guard通用框架,通过身份破坏模块生成跨模型可迁移扰动,可防御多种操纵模型并集成到其他任务中。

详情

展开后加载摘要…

URL PDF HTML 收藏