arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-24 至 2026-03-24 共收录 5 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 5 篇

2603.21884 2026-03-24 cs.CV cs.AI cs.LG 79%

Not All Layers Are Created Equal: Adaptive LoRA Ranks for Personalized Image Generation

并非所有层都同等重要:面向个性化图像生成的自适应LoRA秩

Donald Shenaj, Federico Errica, Antonio Carta

机构 * University of Pisa(比萨大学) NEC Laboratories Europe(NEC 欧洲实验室)

专题命中 个性化与一致性 :image generation(title);diffusion(abstract);分类 cs.CV

AI总结 本文提出LoRA$^2$方法,通过自适应调整各层秩来优化个性化图像生成,实现性能与内存消耗的平衡,优于传统固定秩方法。

Comments Project page: https://donaldssh.github.io/NotAllLayersAreCreatedEqual/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03110 2026-03-24 cs.LG cs.CV 79%

WarmFed: Federated Learning with Warm-Start for Globalization and Personalization Via Personalized Diffusion Models

WarmFed: 通过个性化扩散模型实现全球化与个性化联邦学习的Warm-Start

Tao Feng, Jie Zhang, Xiangjian Li, Rong Huang, Huashan Liu, Zhijie Wang

专题命中 个性化与一致性 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出WarmFed,通过预训练初始化实现全球化与个性化模型的协同优化,采用LoRA生成个性化扩散模型,并结合服务器端微调与动态自我蒸馏提升模型鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11236 2026-03-24 cs.CV 70%

StyleQoRA: Quality-Aware Low-Rank Adaptation for Few-Shot Multi-Style Editing

StyleQoRA: 为少样本多风格编辑的高质量低秩适应

Cong Cao, Huanjing Yue, Yujie Xu, Xiaodong Xu

机构 * SenseTime Group(秒速科技集团) Imvision Tianjin University(天津大学) ACE Robotics(ACE机器人)

专题命中 个性化与一致性 :diffusion(abstract);image editing(abstract);分类 cs.CV

AI总结 本文提出StyleQoRA框架,通过自适应秩确定和混合专家LoRA设计,实现少样本多风格图像编辑的高质量适应,实验表明其参数更少却性能更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20307 2026-03-24 cs.CV cs.AI cs.MM cs.SD 62%

EARTalking: End-to-end GPT-style Autoregressive Talking Head Synthesis with Frame-wise Control

EARTalking:端到端的GPT风格自回归说话头合成与帧级控制

Yuzhe Weng, Haotian Wang, Yuanhong Yu, Jun Du, Shan He, Xiaoyan Wu, Haoran Xu

机构 * University of Science and Technology of China(中国科学技术大学) iFLYTEK Zhejiang University(浙江大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.MM

AI总结 本文提出EARTalking,一种端到端的GPT风格自回归模型,用于交互式音频驱动说话头生成,通过引入帧级流式生成范式和Sink Frame Window Attention机制,实现高效可控的视频生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05905 2026-03-24 cs.CV 57%

SCAIL: Towards Studio-Grade Character Animation via In-Context Learning of 3D-Consistent Pose Representations

SCAIL:通过上下文学习3D一致姿态表示实现工作室级角色动画

Wenhao Yan, Sheng Ye, Zhuoyi Yang, Jiayan Teng, ZhenHui Dong, Kairui Wen, Xiaotao Gu, Yong-Jin Liu, Jie Tang

机构 * Tsinghua University(清华大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 SCAIL通过创新的3D姿态表示和全上下文姿态注入机制,提升角色动画的结构保真度和时间一致性,实现工作室级控制。

详情

展开后加载摘要…

URL PDF HTML 收藏