arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-07-14 至 2026-07-14 共收录 7 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 7 篇

2607.11885 2026-07-14 cs.CV cs.GR 新提交 84%

Latent-Identity Tuning in Text-to-Image Personalization Models

文本到图像个性化模型中的潜在身份调整

Daniel Garibi, Ronen Kamenetsky, Hadar Averbuch-Elor, Daniel Cohen-Or, Or Patashnik

机构 * Tel Aviv University(特拉维夫大学) Cornell University(康奈尔大学)

专题命中 个性化与一致性 :text-to-image(title,abstract);image editing(abstract);分类 cs.CV、cs.GR

AI总结 研究文本到图像个性化模型中细粒度身份调整问题,利用预训练冻结编码器潜在空间,无需额外训练,通过揭示潜在语义方向实现局部、细粒度且语义连贯的面部编辑,经实验验证有效。

Comments Project page at: https://garibida.github.io/IdentityTuning/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10538 2026-07-14 cs.HC cs.CV cs.CY 新提交 79%

Navigating the Open-Source Model Ecosystem: An Empirical Study of Creator Practices in Artistic Image Generation

探索开源模型生态系统:艺术图像生成中创作者实践的实证研究

Yiluo Wei, Yupeng He, Qiming Ye, Gareth Tyson

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

专题命中 个性化与一致性 :image generation(title,abstract);分类 cs.CV

AI总结 本文针对开源图像生成生态系统中创作者模型使用行为展开实证研究,构建含600万张图像及生成元数据的数据集,关联基础模型与LoRA模型使用情况,揭示其优劣势,公开数据集,为创作者和研究人员提供参考。

Comments Accepted to MM'26: The 34th ACM International Conference on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10165 2026-07-14 cs.CV cs.AI 新提交 79%

EmoStyle: Affective Conditioning of Style-Specialist Experts for Emotional Image Generation

EmoStyle:用于情感图像生成的风格专家情感调节

Dexiang Hong, Yijie Guo, Weidong Chen, Xinyan Liu, Zixuan Zou, Zhendong Mao, Yongdong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 个性化与一致性 :image generation(title,abstract);分类 cs.CV

AI总结 针对情感感知艺术图像生成中训练与测试时属性不一致造成的控制差距问题,提出EmoStyle框架,利用语言模型推理器预测情感线索,编码情感字段指导生成,训练专用LoRA适配器结合风格表达情感,经视觉语言模型引导排序,在挑战赛中获佳绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10370 2026-07-14 cs.CV cs.GR 新提交 62%

Neural Motion Blending Across Arbitrary Character Topologies

跨任意角色拓扑的神经运动混合

Luca Cazzola, Giulia Martinelli, Nicola Conci

机构 * University of Trento(特伦托大学) CNIT(意大利国家信息与电信研究所)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

AI总结 研究针对角色动画运动混合,提出跨异构骨架的新框架,结合语义编码器与基于扩散的解码器,通过插值潜在表示实现混合运动,在Truebones Zoo数据集上训练评估,能在多样场景中实现平滑合理的运动混合。

Comments To appear in the proceedings of Computer Graphics International (CGI 2026). For references, please cite the official proceedings version. Paper website: https://mmlab-cv.github.io/neural_motion_blending/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06280 2026-07-14 cs.CV 版本更新 57%

Eulerian Motion Guidance: Robust Image Animation via Bidirectional Geometric Consistency

欧拉运动引导:基于双向几何一致性的鲁棒图像动画

Thong Nguyen, Khoi M. Le, Cong-Duy Nguyen, Luu Anh Tuan, See-Kiong Ng, Chunyan Miao

机构 * National University of Singapore(新加坡国立大学) Centre for AI Research, VinUniversity(Vin大学人工智能研究中心) Nanyang Technological University(南洋理工大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 提出使用相邻帧欧拉运动场引导生成,并通过双向几何一致性机制解决遮挡问题,实现加速训练、保持时间连贯性和减少动态伪影。

Comments Accepted by ACM MM 2026. Code is available at https://github.com/nguyentthong/eulerian_motion_guidance

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10820 2026-07-14 stat.ME 新提交 50%

Causal Estimation of Share-Induced Engagement with Flywheel Effects

基于飞轮效应的分享诱导参与度的因果估计

Weitao Cheng, Yilin Li, Yong Wang, Nian Si

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 研究在线平台分享功能的飞轮效应,开发考虑干扰的实验框架,提出基于流量平衡恒等式的估计器,降低偏差,建立A/A测试程序,扩展到用户级指标,并用真实平台验证方法。

Comments Accepted by KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00982 2026-07-14 math.PR 版本更新 50%

Robust Queueing for Single-Server Queues with Abandonment

具有退队的单服务器队列的鲁棒排队

Wei You

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 本文提出鲁棒排队方法用于近似具有退队的单服务器队列的稳态虚拟等待时间,通过确定性时间变化和重负荷极限改进算法,实现了一种可解的固定点近似,并验证了其在不同负载条件下的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏