arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-13 至 2026-03-13 共收录 4 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 4 篇

2508.09202 2026-03-13 cs.CV cs.AI 70%

Personalized Feature Translation for Expression Recognition: An Efficient Source-Free Domain Adaptation Method

面向表情识别的个性化特征翻译:一种高效的无源域适应方法

Masoumeh Sharafi, Soufiane Belharbi, Muhammad Osama Zeeshan, Houssem Ben Salem, Ali Etemad, Alessandro Lameiras Koerich, Marco Pedersoli, Simon Bacon, Eric Granger

机构 * LIVIA, Dept. of Systems Engineering, ETS Montreal, Canada(蒙特利尔工程学院系统工程系LIVIA) LIVIA, Dept. of Software and IT Engineering, ETS Montreal, Canada(蒙特利尔工程学院软件与IT工程系LIVIA) Dept. of Health, Kinesiology, & Applied Physiology, Concordia University, Montreal, Canada(蒙特利尔大学健康、运动科学与应用生理学系) Montreal Behavioural Medicine Centre, CIUSSS Nord-de-l’Ile-de-Montréal, Canada(蒙特利尔行为医学中心,北岛-蒙特利尔CIUSSS) Dept. of Electrical and Computer Engineering, Queen’s University, Kingston, Canada(皇后大学电气与计算机工程系)

专题命中 个性化与一致性 :image generation(abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出SFDA-PFT方法,通过潜在空间中的特征翻译实现无源域适应,解决中性表情目标数据下的表情识别问题,提升隐私敏感场景下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12257 2026-03-13 cs.CV 57%

DreamVideo-Omni: Omni-Motion Controlled Multi-Subject Video Customization with Latent Identity Reinforcement Learning

DreamVideo-Omni: 基于潜在身份强化学习的多主体视频定制与 Omni-运动控制

Yujie Wei, Xinyu Liu, Shiwei Zhang, Hangjie Yuan, Jinbo Xing, Zhekai Chen, Xiang Wang, Haonan Qiu, Rui Zhao, Yutong Feng, Ruihang Chu, Yingya Zhang, Yike Guo, Xihui Liu, Hongming Shan

机构 * Fudan University(复旦大学) The Hong Kong University of Science and Technology(香港科技大学) Tongyi Lab, Alibaba Group(阿里云实验室) Zhejiang University(浙江大学) MMLab, The University of Hong Kong(香港大学MMLab) Nanyang Technological University(南洋理工大学) Show Lab, National University of Singapore(新加坡国立大学Show Lab)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 DreamVideo-Omni通过渐进式两阶段训练范式,实现多主体视频定制与Omni-运动控制,采用条件感知嵌入和分层运动注入策略,提升身份保持与运动控制精度。

Comments Project Page: https://dreamvideo-omni.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10354 2026-03-13 cs.CV 57%

StyleGallery: Training-free and Semantic-aware Personalized Style Transfer from Arbitrary Image References

StyleGallery: 无需训练且语义感知的任意图像参考个性化风格迁移

Boyu He, Yunfan Ye, Chang Liu, Weishang Wu, Fang Liu, Zhiping Cai

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 StyleGallery通过语义感知和无需训练的框架,实现任意图像参考的个性化风格迁移,提升内容保留与风格化平衡能力。

Comments 18 pages, 23 figures, Conference on Computer Vision and Pattern Recognition 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03964 2026-03-13 cs.CV cs.AI 57%

BLOCK: An Open-Source Bi-Stage MLLM Character-to-Skin Pipeline for Minecraft

BLOCK:一个开源的双阶段MLLM字符到皮肤生成Minecraft pipeline

Hengquan Guo

专题命中 个性化与一致性 :text-to-image(abstract);分类 cs.CV

AI总结 BLOCK通过双阶段流程生成Minecraft皮肤,结合MLLM和FLUX.2模型,提出EvolveLoRA提升生成稳定性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏