arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-04-01 至 2026-04-01 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 3 篇

2603.29736 2026-04-01 cs.MM 89%

Editing on the Generative Manifold: A Theoretical and Empirical Study of General Diffusion-Based Image Editing Trade-offs

生成流形上的编辑:通用扩散图像编辑权衡的理论与实证研究

Yi Hu, Leying Yi, Emily Davis, Finn Carter

专题命中 图像编辑 :diffusion(title,abstract);image editing(title,abstract);inpainting(abstract);分类 cs.MM

AI总结 本文理论与实证分析了通用扩散图像编辑,通过将编辑视为引导传输在学习图像流形上的过程,探讨了可控性、意图忠实度、语义一致性、局部性和感知质量等核心指标。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29602 2026-04-01 cs.GR cs.AI cs.CV cs.MA 81%

IMAGAgent: Orchestrating Multi-Turn Image Editing via Constraint-Aware Planning and Reflection

IMAGAgent:通过约束感知规划与反思协调多轮图像编辑

Fei Shen, Chengyu Xie, Lihong Wang, Zhanyi Zhang, Xin Jiang, Xiaoyu Du, Jinhui Tang

机构 * National University of Singapore(新加坡国立大学) Nanjing University of Science and Technology(南京理工大学) Nanjing Forestry University(南京林业大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV、cs.GR

AI总结 IMAGAgent通过闭环机制整合指令解析、工具调度与自适应修正,解决多轮图像编辑中的上下文感知与反馈问题,提升编辑精度与整体质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29386 2026-04-01 cs.CV cs.AI 57%

PromptForge-350k: A Large-Scale Dataset and Contrastive Framework for Prompt-Based AI Image Forgery Localization

PromptForge-350k:一种大规模数据集和对比框架用于基于提示的AI图像伪造定位

Jianpeng Wang, Haoyu Wang, Baoying Chen, Jishen Zeng, Yiming Qin, Yiqi Yang, Zhongjie Ba

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

AI总结 本文提出PromptForge-350k数据集和ICL-Net网络,通过自动化标注框架和对比学习提升伪造定位精度,实验显示在IoU指标上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏