arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-05-11 至 2026-05-11 共收录 4 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4 篇

2605.08050 2026-05-11 cs.CV 79%

MoCoTalk: Multi-Conditional Diffusion with Adaptive Router for Controllable Talking Head Generation

MoCoTalk: 多条件扩散与自适应路由的可控说话头生成

Xinyan Ye, Jiankang Deng, Abbas Edalat

机构 * Imperial College London(帝国理工学院伦敦分校)

专题命中 可控生成 :diffusion(title,abstract);分类 cs.CV

AI总结 MoCoTalk通过统一身份、头部姿态、面部表情和嘴部动态四个控制信号,提出自适应多条件路由框架,解决异构条件干扰问题,提升可控说话头生成的性能与可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15507 2026-05-11 cs.CV 79%

A Unified and Controllable Framework for Layered Image Generation with Visual Effects

用于具有视觉效果的分层图像生成的统一且可控的框架

Jinrui Yang, Qing Liu, Yijun Li, Mengwei Ren, Letian Zhang, Zhe Lin, Cihang Xie, Yuyin Zhou

机构 * UC Santa Cruz(加州大学圣克鲁兹分校) Adobe Research(Adobe研究)

专题命中 可控生成 :image generation(title,abstract);分类 cs.CV

AI总结 本文提出LASAGNA框架,通过单次前向传递生成逼真背景和具有视觉效果的RGBA前景,支持多种编辑操作,消除身份漂移,同时发布两个社区资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01248 2026-05-11 cs.CV 70%

NS-Net: Decoupling CLIP Semantic Information through NULL-Space for Generalizable AI-Generated Image Detection

NS-Net:通过NULL空间解耦CLIP语义信息以实现通用的AI生成图像检测

Jiazhen Yan, Fan Wang, Weiwei Jiang, Ziqiang Li, Zhangjie Fu

机构 * Engineering Research Center of Digital Forensics, Ministry of Education, Nanjing University of Information Science and Technology(数字取证工程研究中心,教育部,南京信息科技大学) University of Macau(澳门大学)

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出NS-Net,通过NULL空间投影解耦CLIP视觉特征中的语义信息,结合对比学习捕捉真实与生成图像的分布差异,提升AI生成图像检测的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07539 2026-05-11 cond-mat.mes-hall cond-mat.soft physics.optics 50%

Exciton-mediated optical control of liquid-solid friction

激子介导的液体-固体摩擦光学控制

Timur Pryadilin, Alexey Kavokin, Baptiste Coquinot

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出了一种基于光生成激子与水电荷波动耦合的微观理论,研究了纳米流体系统界面摩擦,并展示了通过光学调控可显著减少纳米通道的滑移长度和液压渗透性。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏