arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-14 至 2026-08-14 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 2 篇

2608.12876 2026-08-14 cs.CV cs.AI 新提交 57%

SPARED: Reasoning-Based AI-Generated Image Detection via Adversarially Edited Data

SPARED:基于推理的AI生成图像检测方法,采用对抗编辑数据

Yicheng Bao, Xiahui Guo, Xuhong Wang, Xin Tan

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

AI总结 本研究提出对抗强化学习框架SPARED,通过扩散图像编辑器与推理型MLLM的交替博弈,训练出能抗捷径、泛化能力强的AI生成图像检测器,在三个外部基准上性能单调提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09057 2026-08-14 cs.CV 版本更新 57%

Model the Edit, Not the Image: Visual Autoregressive Editing from a Source-Centric Perspective

建模编辑,而非图像:以源为中心视角的视觉自回归编辑

Hongyi Fang, Chuwen Xie, Benjia Zhou, Yu-Xuan Qiu, Chenggong Hu, Zhibin Wang, Chao Chen, Jianbin Qin, Rui Mao

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

AI总结 该研究针对视觉自回归模型(VARs)编辑的现有不足,提出以源为中心视角的EditMod方法,实现了高保真度与强文本对齐的1K图像端到端编辑,速度达1.57秒/张A100 GPU。

详情

展开后加载摘要…

URL PDF HTML 收藏