arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-04-15 至 2026-04-15 共收录 7 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 7 篇

2604.12969 2026-04-15 cs.CV 79%

AbdomenGen: Sequential Volume-Conditioned Diffusion Framework for Abdominal Anatomy Generation

AbdomenGen:用于腹部解剖生成的序列体积条件扩散框架

Yubraj Bhandari, Lavsen Dahal, Paul Segars, Joseph Y. Lo

机构 * Center for Virtual Imaging Trials, Dept. of Radiology, Duke University School of Medicine(虚拟成像试验中心,放射科,杜克大学医学部) Dept. of Electrical and Computer Engineering, Pratt School of Engineering, Duke University(电气与计算机工程系,普拉特工程学院,杜克大学) Dept. of Physics, Trinity School of Arts and Sciences, Duke University(物理系,特里尼蒂艺术与科学学院,杜克大学)

专题命中 可控生成 :diffusion(title,abstract);分类 cs.CV

AI总结 AbdomenGen提出了一种序列体积条件扩散框架,通过Volume Control Scalar实现可控的腹部解剖生成,实现了高几何保真度和多器官解耦调节。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12622 2026-04-15 cs.CV cs.AI cs.NI 70%

Efficient Semantic Image Communication for Traffic Monitoring at the Edge

边缘交通监控中的高效语义图像通信

Damir Assylbek, Nurmukhammed Aitymbetov, Marko Ristin, Dimitrios Zorbas

机构 * Nazarbayev University, School of Engineering & Digital Sciences(纳扎尔拜耶夫大学工程与数字科学学院) Zurich University of Applied Sciences (ZHAW)(苏黎世应用科学大学(ZHAW))

专题命中 可控生成 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出MMSD和SAMR两种语义图像通信管道,通过压缩和加密实现高效传输,同时保持视觉信息。MMSD用语义表示替代原始图像,SAMR通过语义重要性选择性抑制区域,两者均采用边缘轻量处理与服务器重计算的异构架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13028 2026-04-15 cs.CV 57%

Conflated Inverse Modeling to Generate Diverse and Temperature-Change Inducing Urban Vegetation Patterns

融合反演建模生成多样且能引起温度变化的城区植被模式

Baris Sarper Tezcan, Hrishikesh Viswanath, Rubab Saher, Daniel Aliaga

机构 * Computer Science(计算机科学) Forestry and Natural Resources(林业与自然资源)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 本文提出融合预测正模与扩散基生成反模的反演框架,用于生成多样且符合特定温度目标的城区植被模式,解决传统方法在数据稀少时无法捕捉模糊性的不足。

Comments Accepted to the CVPR 2026 EarthVision Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12322 2026-04-15 cs.CV 57%

Self-Adversarial One Step Generation via Condition Shifting

通过条件位移实现自对抗一步生成

Deyuan Liu, Peng Sun, Yansen Han, Zhenglin Cheng, Chuyan Chen, Tao Lin

机构 * Westlake University(西拉丘学院) Zhejiang University(浙江大学) Shanghai Innovation Institute(上海创新研究院) Peking University(北京大学)

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

AI总结 本文提出APEX框架,通过条件位移内生提取对抗信号,实现无需外部判别器的一步生成,提升生成质量与推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11964 2026-04-15 cs.HC cs.MM 57%

When Drawing Is Not Enough: Exploring Spontaneous Speech with Sketch for Intent Alignment in Multimodal LLMs

当绘画不够时:探索通过草图进行意图对齐的自发性言语在多模态大语言模型中的应用

Weiyan Shi, Dorien Herremans, Kenny Tsu Wei Choo

专题命中 可控生成 :image generation(abstract);分类 cs.MM

AI总结 本文探讨了在多模态大语言模型中,通过草图与自发性言语的结合来提升设计初期意图对齐的效果,通过实验表明加入自发性言语能显著提高生成图像的意图匹配度。

Comments Accepted at DIS 2026 PWiP

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11843 2026-04-15 cs.CV 57%

UniMark: Unified Adaptive Multi-bit Watermarking for Autoregressive Image Generators

UniMark: 为自回归图像生成器设计的统一自适应多比特水印方案

Yigit Yilmaz, Elena Petrova, Mehmet Kaya, Lucia Rossi, Amir Rahman

机构 * Bandırma Onyedi Eylül University(班迪马奥克西迪埃普大学)

专题命中 可控生成 :image generation(abstract);分类 cs.CV

AI总结 UniMark提出一种无需训练的统一水印框架,解决自回归图像生成中水印嵌入能力弱、安全性和通用性差的问题,通过自适应语义分组、块级多比特编码和统一令牌替换接口实现高质量图像保护和多比特信息传输。

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12153 2026-04-15 math.OC 50%

Nonlinear Stochastic Optimal Control and Optimal Stopping using the Fokker-Planck Transformation

非线性随机最优控制与最优停止的福克-计划克变换

Akan Selim, Siddhartha Ganguly, Ali Pakniyat, Panagiotis Tsiotras

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出一种非线性随机最优控制与最优停止的理论框架,通过建立扩散过程的密度确定性表示,推导出确定性特征动力学,复现随机系统的边际规律,并利用Stein型恒等式展示分布动态规划方程与分布随机Hamilton-Jacobi-Bellman公式的相同二阶微分算子。

Comments 40 pages, submitted to a journal

详情

展开后加载摘要…

URL PDF HTML 收藏