arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1266 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 1266 篇

2604.26633 2026-07-23 cs.CV cs.AI 版本更新 70%

SynSur: An end-to-end generative pipeline for synthetic industrial surface defect generation and detection

SynSur:一种端到端的生成管道用于合成工业表面缺陷的生成与检测

Paul Julius Kühn, Mika Pommeranz, Arjan Kuijper, Saptarshi Neil Sinha

机构 * Fraunhofer IGD(弗劳恩霍夫工业驱动研究所)

专题命中 个性化与一致性 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出SynSur端到端生成管道,结合视觉-语言模型提示、LoRA适应扩散、掩码引导修复和样本筛选,通过合成数据缓解工业缺陷检测数据稀缺问题,并在跨领域迁移中验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29308 2026-06-30 cs.CV 70%

MirrorPPR: Exemplar-Based Portrait Photo Retouching

MirrorPPR:基于示例的人像照片修图

Zhihong Liu, Zheng Li, Jiachun Jin, Siqi Kou, Yitao Jian, Fengpei Yu, Zhijie Deng

机构 * Shanghai Jiao Tong University(上海交通大学) Triverse AI

专题命中 个性化与一致性 :diffusion(abstract);image editing(abstract);分类 cs.CV

AI总结 提出MirrorPPR框架,通过修图操作提取器和LoRA模块将示例对中的细微结构修图操作迁移到新图像,并构建大规模数据集MirrorPPR47M实现渐进式学习,显著提升修图质量和身份保持。

Comments Accepted by ECCV 2026. 27 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22679 2026-06-23 cs.LG cs.CV 版本更新 70%

Stabilizing Consistency Training: A Flow Map Analysis and Self-Distillation

稳定一致性训练:流映射分析与自蒸馏

Youngjoong Kim, Duhoe Kim, Woosung Kim, Jaesik Park

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Seoul National University(首尔国立大学) Interdisciplinary Program in Artificial Intelligence(人工智能跨学科项目)

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文从流映射角度分析一致性模型的不稳定性与退化解,提出基于自蒸馏的优化策略以避免梯度爆炸,并在图像生成和扩散策略学习中验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13809 2026-06-15 cs.CV 新提交 70%

Compressing Image Style Training into a Single Model Forward

将图像风格训练压缩为单次模型前向传播

Zhongjie Duan, Yingda Chen

机构 * ModelScope Team, Alibaba Group(阿里巴巴集团 ModelScope 团队)

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 提出i2L框架,通过单次前向传播预测LoRA权重,实现高效风格迁移,避免逐风格优化,在风格保真度、提示对齐和感知质量上超越现有基线。

Comments 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25378 2026-05-28 cs.CV cs.AI 70%

CollectionLoRA: Collecting 50 Effects in 1 LoRA via Multi-Teacher On-Policy Distillation

CollectionLoRA: 通过多教师在线策略蒸馏将50种效果收集到1个LoRA中

Fangtai Wu, Hailong Guo, Shijie Huang, Jiayi Song, Yubo Huang, Mushui Liu, Zhao Wang, Yunlong Yu, Jiaming Liu, Ruihua Huang

机构 * Zhejiang University(浙江大学) Qwen Applications Business Group of Alibaba(阿里巴巴Qwen应用业务组) Xi'an Jiaotong University(西安交通大学)

专题命中 个性化与一致性 :diffusion(abstract);image editing(abstract);分类 cs.CV

AI总结 提出CollectionLoRA框架,通过多教师在线策略蒸馏将多达50种不同效果LoRA和少步生成能力整合到单个LoRA中,解决参数干扰并降低部署成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00607 2026-05-19 cs.CV cs.AI 70%

IdGlow: Dynamic Identity Modulation for Multi-Subject Generation

IdGlow: 多主体生成中的动态身份调节

Honghao Cai, Xiangyuan Wang, Jing Li, Yunhao Bai, Tianze Zhou, Haohua Chen, Chao Hui, Changhao Qiao, Runqi Wang, Sijie Xu, Yuyang Hao, Zezhou Cui, Yuyuan Yang, Wei Zhu, Yibo Chen, Xu Tang, Yao Hu, Zhen Li

机构 * Xiaohongshu Inc.(小红书公司) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Peking University(北京大学) Tsinghua University(清华大学)

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出IdGlow框架,通过任务自适应的时间步调度和视觉语言模型解决多主体生成中的稳定性与可塑性矛盾,提升面部真实感与商业级美学质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19455 2026-05-08 cs.CV 70%

Masked Language Prompting for Generative Data Augmentation in Few-shot Fashion Style Recognition

生成数据增强的掩码语言提示在少样本时尚风格识别中的应用

Yuki Hirakawa, Ryotaro Shimizu

机构 * ZOZO Research(ZOZO研究院)

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出掩码语言提示方法,通过掩码参考描述中的词并利用大语言模型生成多样且语义连贯的图像,提升少样本时尚风格识别的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16702 2026-04-28 cs.CV 70%

Animalbooth: multimodal feature enhancement for animal subject personalization

Animalbooth:多模态特征增强用于动物主体个性化

Chen Liu, Haitao Wu, Kafeng Wang, Weiran Huang

机构 * College of Intelligence and Computing(智能与计算学院) Department of Computer Science and Technology(计算机科学与技术系) School of Computer Science(计算机科学学院)

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 针对动物图像生成中丰富的外观线索和形态多样性带来的挑战,AnimalBooth通过Animal Net和自适应注意力模块增强身份保持,结合频域控制特征整合模块提升扩散过程的全局结构到细节纹理的逐步生成,同时构建AnimalBench数据集验证了其在多个基准上的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13841 2026-04-16 cs.CV 70%

DiffMagicFace: Identity Consistent Facial Editing of Real Videos

DiffMagicFace: 实现实时视频中人脸的恒定身份编辑

Huanghao Yin, Shenkun Xu, Kanle Shi, Junhai Yong, Bin Wang

机构 * Tsinghua University(清华大学)

专题命中 个性化与一致性 :diffusion(abstract);image editing(abstract);分类 cs.CV

AI总结 本文提出DiffMagicFace框架,通过整合文本和图像控制模型,实现视频中人脸编辑时保持身份一致性和内容一致性,无需依赖视频数据集,效果在视觉和量化指标上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10023 2026-04-14 cs.CV cs.AI 70%

FREE-Switch: Frequency-based Dynamic LoRA Switch for Style Transfer

FREE-Switch: 基于频率的动态LoRA切换用于风格迁移

Shenghe Zheng, Minyu Zhang, Tianhao Liu, Hongzhi Wang

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出FREE-Switch方法,通过频率域重要性驱动动态LoRA切换,结合不同对象和风格的适配器,降低高质量定制生成的训练成本。

Comments CVPR Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22690 2026-04-02 cs.CV 70%

Ar2Can: An Architect and an Artist Leveraging a Canvas for Multi-Human Generation

Ar2Can:利用画布进行多人体生成的架构与艺术家

Shubhankar Borse, Phuc Pham, Farzad Farhadzadeh, Seokeon Choi, Phong Ha Nguyen, Anh Tuan Tran, Sungrack Yun, Munawar Hayat, Fatih Porikli

机构 * Qualcomm AI Research, an initiative of Qualcomm Technologies, Inc.(高通人工智能研究院,高通技术公司旗下)

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 Ar2Can提出一种两阶段框架,通过分离空间规划与身份渲染,解决多人体生成中人脸身份丢失问题,采用空间引导的面部匹配奖励提升生成质量,使用合成数据实现高精度和保真度。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29356 2026-04-01 cs.CV cs.AI 70%

CIPHER: Counterfeit Image Pattern High-level Examination via Representation

CIPHER: 通过表征进行伪造图像模式高层检查

Kyeonghun Kim, Youngung Han, Seoyoung Ju, Yeonju Jean, YooHyun Kim, Minseo Choi, SuYeon Lim, Kyungtae Park, Seungwoo Baek, Sieun Hyeon, Nam-Joon Kim, Hyuk-Jae Lee

机构 * OUTTA Seoul National University(首尔国立大学)

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出CIPHER框架,通过重用和微调生成模型判别器,提取多尺度特征和时间一致性特征,实现跨模型的深度伪造检测,实验表明其在F1-score上优于现有方法。

Comments 6 pages, 2 figures. Accepted at IEEE-Asia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11236 2026-03-24 cs.CV 70%

StyleQoRA: Quality-Aware Low-Rank Adaptation for Few-Shot Multi-Style Editing

StyleQoRA: 为少样本多风格编辑的高质量低秩适应

Cong Cao, Huanjing Yue, Yujie Xu, Xiaodong Xu

机构 * SenseTime Group(秒速科技集团) Imvision Tianjin University(天津大学) ACE Robotics(ACE机器人)

专题命中 个性化与一致性 :diffusion(abstract);image editing(abstract);分类 cs.CV

AI总结 本文提出StyleQoRA框架,通过自适应秩确定和混合专家LoRA设计,实现少样本多风格图像编辑的高质量适应,实验表明其参数更少却性能更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09202 2026-03-13 cs.CV cs.AI 70%

Personalized Feature Translation for Expression Recognition: An Efficient Source-Free Domain Adaptation Method

面向表情识别的个性化特征翻译:一种高效的无源域适应方法

Masoumeh Sharafi, Soufiane Belharbi, Muhammad Osama Zeeshan, Houssem Ben Salem, Ali Etemad, Alessandro Lameiras Koerich, Marco Pedersoli, Simon Bacon, Eric Granger

机构 * LIVIA, Dept. of Systems Engineering, ETS Montreal, Canada(蒙特利尔工程学院系统工程系LIVIA) LIVIA, Dept. of Software and IT Engineering, ETS Montreal, Canada(蒙特利尔工程学院软件与IT工程系LIVIA) Dept. of Health, Kinesiology, & Applied Physiology, Concordia University, Montreal, Canada(蒙特利尔大学健康、运动科学与应用生理学系) Montreal Behavioural Medicine Centre, CIUSSS Nord-de-l’Ile-de-Montréal, Canada(蒙特利尔行为医学中心,北岛-蒙特利尔CIUSSS) Dept. of Electrical and Computer Engineering, Queen’s University, Kingston, Canada(皇后大学电气与计算机工程系)

专题命中 个性化与一致性 :image generation(abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出SFDA-PFT方法,通过潜在空间中的特征翻译实现无源域适应,解决中性表情目标数据下的表情识别问题,提升隐私敏感场景下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18734 2026-03-10 cs.CV cs.AI 70%

Yo'City: Personalized and Boundless 3D Realistic City Scene Generation via Self-Critic Expansion

Yo'City:通过自批评扩展实现个性化和无边界的3D逼真城市场景生成

Keyang Lu, Sifan Zhou, Hongbin Xu, Gang Xu, Zhifei Yang, Yikai Wang, Zhen Xiao, Jieyi Long, Ming Li

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) Beihang University(北航) Southeast University(东南大学) ByteDance Seed(字节跳动种子) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室) Beijing Normal University(北京师范大学) Theta Labs(Theta实验室)

专题命中 个性化与一致性 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 Yo'City通过自批评扩展实现个性化和无边界的3D城市生成,利用大模型的推理能力提升生成质量。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18936 2026-03-04 cs.CV 70%

CRAFT-LoRA: Content-Style Personalization via Rank-Constrained Adaptation and Training-Free Fusion

CRAFT-LoRA: 通过秩约束适应与无训练融合实现内容-风格个性化

Yu Li, Yujun Cai, Chi Zhang

机构 * AGI Lab, Westlake University(西莱大学AGI实验室) George Washington University(乔治华盛顿大学) The University of Queensland(昆士兰大学)

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 CRAFT-LoRA通过秩约束适应与无训练融合实现内容-风格个性化,提升生成稳定性与语义控制灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06336 2026-02-24 cs.CV cs.LG eess.IV 70%

MEt3R: Measuring Multi-View Consistency in Generated Images

MEt3R:测量生成图像的多视图一致性

Mohammad Asim, Christopher Wewer, Thomas Wimmer, Bernt Schiele, Jan Eric Lenssen

机构 * Max Planck Institute for Informatics(马克斯·普朗克信息研究所) Saarland Informatics Campus(萨尔州信息校园) ETH Zurich(苏黎世联邦理工学院)

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 MEt3R是一种用于评估生成图像多视图一致性的新指标,通过密集3D重建和特征比较,独立于场景和采样过程,评估生成模型的质量。

Comments Project website: https://geometric-rl.mpi-inf.mpg.de/met3r/ Updated to Camera-Ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21736 2026-02-09 cs.CV 70%

SyncAnyone: Implicit Disentanglement via Progressive Self-Correction for Lip-Syncing in the wild

SyncAnyone: 通过渐进自我校正实现隐式解耦以实现野外对口型同步

Xindi Zhang, Dechao Meng, Steven Xiao, Qi Wang, Peng Zhang, Bang Zhang

机构 * Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团)

专题命中 个性化与一致性 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 SyncAnyone通过渐进自我校正实现隐式解耦,提升野外对口型同步的精度和视觉保真度。

Comments Project page: https://humanaigc.github.io/sync_anyone_demo_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06043 2026-02-06 cs.LG cs.AI cs.CV 70%

Shared LoRA Subspaces for almost Strict Continual Learning

共享LoRA子空间用于近严格持续学习

Prakhar Kaushik, Ankit Vaidya, Shravan Chaudhari, Rama Chellappa, Alan Yuille

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 Share通过共享低秩子空间实现高效持续学习,减少参数和内存消耗,提升多任务适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05339 2026-02-06 cs.CV cs.LG 70%

Consistency-Preserving Concept Erasure via Unsafe-Safe Pairing and Directional Fisher-weighted Adaptation

通过不安全-安全配对和方向性Fisher加权适应进行一致性保持的概念擦除

Yongwoo Kim, Sungmin Cha, Hyunsoo Kim, Jaewon Lee, Donghyun Kim

机构 * Korea University(韩国大学) New York University(纽约大学) Korea Institute of Science(韩国科学技术院)

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出PAIR框架,通过不安全-安全配对和方向性Fisher加权适应,实现对有害概念的精细化擦除,保持生成内容的结构和语义一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01306 2026-02-03 cs.CV 70%

DeCorStory: Gram-Schmidt Prompt Embedding Decorrelation for Consistent Storytelling

DeCorStory: 通过Gram-Schmidt提示嵌入去相关实现一致叙事

Ayushman Sarkar, Zhenyu Yu, Mohd Yamani Idna Idris

机构 * Birbhum Institute of Engineering and Technology(比尔布尔理工学院) Universiti Malaya(马来亚大学)

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 DeCorStory通过Gram-Schmidt提示嵌入去相关和跨注意力机制,提升文本到图像叙事中的一致性和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01305 2026-02-03 cs.CV 70%

StoryState: Agent-Based State Control for Consistent and Editable Storybooks

StoryState: 基于代理的状态控制用于一致且可编辑的故事书

Ayushman Sarkar, Zhenyu Yu, Wei Tang, Chu Chen, Kangning Cui, Mohd Yamani Idna Idris

机构 * Birbhum Institute of Engineering and Technology(比尔布尔工程科技学院) Universiti Malaya(马来亚大学) City University of Hong Kong(香港城市大学) Wake Forest University(威克森林大学)

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 StoryState通过基于代理的状态控制实现多页故事书的一致性与编辑优化

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20626 2026-02-03 cs.CV 70%

ConsiStyle: Style Diversity in Training-Free Consistent T2I Generation

ConsiStyle: 训练无一致性T2I生成中的风格多样性

Yohai Mazuz, Janna Bruner, Lior Wolf

机构 * Tel Aviv University(特拉维夫大学)

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 ConsiStyle提出一种训练无方法,首次实现不同风格下风格保持和主体一致性的联合优化,通过调整注意力矩阵和统计特性对齐,解耦风格与外观,实现高质量文本对齐图像生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17008 2026-02-02 cs.CV 70%

FlashFace: Human Image Personalization with High-fidelity Identity Preservation

FlashFace: 通过高保真身份保留实现人像个性化

Shilong Zhang, Lianghua Huang, Xi Chen, Yifei Zhang, Zhi-Fan Wu, Yutong Feng, Wei Wang, Yujun Shen, Yu Liu, Ping Luo

机构 * The University of Hong Kong(香港大学) Alibaba Group(阿里巴巴集团) Ant Group(蚂蚁集团)

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 FlashFace通过高保真身份保留和解耦整合策略,实现高效的人像个性化与虚拟角色真实化

Comments Project Page:https://jshilong.github.io/flashface-page

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23515 2026-01-30 cs.CV 70%

FreeFuse: Multi-Subject LoRA Fusion via Adaptive Token-Level Routing at Test Time

FreeFuse: 通过测试时自适应的token级路由实现多主体LoRA融合

Yaoli Liu, Yao-Xiang Ding, Kun Zhou

机构 * State Key Laboratory of CAD&CG(计算机辅助设计与图形学国家重点实验室)

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 FreeFuse通过测试时自适应token级路由实现多主体LoRA融合,无需额外训练或模型修改,仅需主体激活词即可实现无缝图像生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17323 2026-01-30 cs.CV 70%

SkyReels-V3 Technique Report

SkyReels-V3 技术报告

Debang Li, Zhengcong Fei, Tuanhui Li, Yikun Dou, Zheng Chen, Jiangping Yang, Mingyuan Fan, Jingtao Xu, Jiahua Wang, Baoxuan Gu, Mingshan Chang, Wenjing Cai, Yuqiang Xie, Binjie Mao, Youqiang Zhang, Nuo Pang, Hao Zhang, Yuzhe Jin, Zhiheng Xu, Dixuan Lin, Guibin Chen, Yahui Zhou

机构 * SkyReels Team(SkyReels 团队)

专题命中 个性化与一致性 :diffusion(abstract);image editing(abstract);分类 cs.CV

AI总结 SkyReels-V3 提出三种视频生成范式,通过多模态上下文学习框架实现高质量视频生成,涵盖图像到视频、视频扩展和音频引导生成,达到接近闭源系统的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09475 2026-01-26 cs.CV cs.LG 70%

Few-shot multi-token DreamBooth with LoRa for style-consistent character generation

少样本多令牌DreamBooth结合LoRa用于风格一致的角色生成

Ruben Pascual, Mikel Sesma-Sara, Aranzazu Jurio, Daniel Paternain, Mikel Galar

机构 * Institute of Smart Cities (ISC)(智能城市研究所) Department of Statistics, Computer Science and Mathematics(统计学、计算机科学与数学系) Public University of Navarre (UPNA)(纳瓦拉公共大学)

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出结合LoRA的多令牌DreamBooth方法,实现少样本下风格一致的角色生成,提升动画和游戏领域的创作可能性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15560 2026-01-23 cs.CV 70%

Relative Classification Accuracy: A Calibrated Metric for Identity Consistency in Fine-Grained K-pop Face Generation

相对分类准确率:一种用于细粒度K-pop人脸生成中身份一致性的校准度量

Sylvey Lin, Eranki Vasistha

机构 * UIUC(伊利诺伊大学香槟分校)

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出相对分类准确率(RCA)作为评估细粒度K-pop人脸生成中身份一致性的校准度量,揭示了高视觉质量与严重语义模式崩溃之间的关键权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15542 2026-01-13 cs.CV 70%

BLANKET: Anonymizing Faces in Infant Video Recordings

BLANKET:婴儿视频记录中的人脸匿名化

Ditmar Hadera, Jan Cech, Miroslav Purkrabek, Matej Hoffmann

机构 * Department of Cybernetics, Faculty of Electrical Engineering, Czech Technical University in Prague(控制系、电气工程系、布拉格捷克技术大学)

专题命中 个性化与一致性 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 BLANKET通过生成与原身份兼容的新随机人脸并结合时间一致的面部交换,实现婴儿视频中的人脸匿名化,同时保留关键面部属性,优于现有方法DeepPrivacy2。

Comments Project website: https://github.com/ctu-vras/blanket-infant-face-anonym

Journal ref 2025 IEEE International Conference on Development and Learning (ICDL)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17005 2026-01-07 cs.CV cs.AI 70%

FLUID: Training-Free Face De-identification via Latent Identity Substitution

FLUID:无需训练的面部去标识化通过潜在身份替换

Jinhyeong Park, Shaheryar Muhammad, Seangmin Lee, Jong Taek Lee, Soon Ki Jung

机构 * Kyungpook National University(庆尚国立大学)

专题命中 个性化与一致性 :diffusion(abstract);image editing(abstract);分类 cs.CV

AI总结 FLUID通过在预训练扩散模型的潜在空间中直接替换身份特征,实现了无需训练的面部去标识化,有效平衡了身份抑制与属性保持。

详情

展开后加载摘要…

URL PDF HTML 收藏