arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-04 至 2026-03-04 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3 篇

2511.07970 2026-03-04 cs.LG 89%

Continual Unlearning for Text-to-Image Diffusion Models: A Regularization Perspective

文本到图像扩散模型的持续反学习:一种正则化视角

Justin Lee, Zheda Mai, Jinsu Yoo, Chongyu Fan, Cheng Zhang, Wei-Lun Chao

机构 * The Ohio State University(俄亥俄州立大学) Michigan State University(密歇根州立大学) Texas A&M University(德克萨斯大学安德森分校) Boston University(波士顿大学)

专题命中 文生图 :text-to-image(title,abstract);diffusion(title,abstract);image generation(abstract)

AI总结 本文提出通过正则化方法解决文本到图像扩散模型中持续反学习的问题,通过减轻参数漂移和增强语义意识,提升反学习性能并推动生成式AI的安全发展。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17623 2026-03-04 cs.MM cs.CV 62%

Synthetic Perception: Can Generated Images Unlock Latent Visual Prior for Text-Centric Reasoning?

合成感知:生成图像能否解锁潜在的视觉先验以用于以文本为中心的推理?

Yuesheng Huang, Peng Zhang, Xiaoxin Wu, Riliang Liu, Jiaqi Liang

专题命中 文生图 :text-to-image(abstract);分类 cs.CV、cs.MM

AI总结 本文探讨生成图像能否解锁潜在视觉先验以提升文本中心推理,通过多模态融合架构和提示工程策略实现性能提升。

Comments Accepted as a poster at the International Conference on Machine Learning (ICML 2025) NewInML Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03163 2026-03-04 cs.CV cs.AI 57%

Conditioned Activation Transport for T2I Safety Steering

基于条件激活传输的T2I安全引导

Maciej Chrabąszcz, Aleksander Szymczyk, Jan Dubiński, Tomasz Trzciński, Franziska Boenisch, Adam Dziedzic

机构 * NASK National Research Institute(NASK国家研究所) Warsaw University of Technology(华沙技术大学) IDEAS Research Institute(IDEAS研究 institute) CISPA Helmholtz Center for Information Security(CISPA海德堡中心 for 信息安全)

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

AI总结 本文提出条件激活传输框架,通过几何条件机制和非线性传输映射,有效减少T2I生成不安全内容的风险,提升图像生成的安全性与保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏