arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-05-14 至 2026-05-14 共收录 9 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 9 篇

2507.01908 2026-05-14 cs.CV 85%

Reasoning to Edit: Hypothetical Instruction-Based Image Editing with Visual Reasoning

基于推理的编辑:基于假设指令的图像编辑与视觉推理

Qingdong He, Xueqin Chen, Chaoyi Wang, Yanjie Pan, Xiaobin Hu, Zhenye Gan, Yabiao Wang, Chengjie Wang, Xiangtai Li, Jiangning Zhang

机构 * Tencent Youtu Lab(腾讯云图实验室) Sichuan University(四川大学) University of the Chinese Academy of Sciences(中国科学院大学) Fudan University(复旦大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文提出Reason50K数据集和ReasonBrain框架,通过多模态大语言模型和扩散模型实现复杂隐含指令的图像编辑,提升视觉推理能力。

Comments Accepted by ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13349 2026-05-14 cs.CV 83%

Drag within Prior Distribution: Text-Conditioned Point-Based Image Editing within Distribution Constraints

在先验分布中进行拖拽:基于文本的点基图像编辑在分布约束内

Haoyang Hu, Masataka Seo, Yen-Wei Chen

机构 * Ritsumeikan University, Graduate School of Information(日光大学信息工程研究生院) Engineering, Osaka Institute of Technology(工程学,大阪技术学院)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出基于CLIP模型的编辑引导方法和先验保留损失,以提高图像编辑的语义一致性和生成质量,同时减少编辑时间。

Comments ICASSP 2026 oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13122 2026-05-14 cs.CV 83%

Early Semantic Grounding in Image Editing Models for Zero-Shot Referring Image Segmentation

图像编辑模型中的早期语义接地用于零样本指引用图像分割

Jingxuan He, Xiyu Wang, Yunke Wang, Mengyu Zheng, Chang Xu

机构 * The University of Sydney(悉尼大学)

专题命中 图像编辑 :image editing(title,abstract);image synthesis(abstract);分类 cs.CV

AI总结 本文探讨利用图像编辑模型的隐含语义接地能力进行零样本指引用图像分割,通过分析发现早期去噪步骤即可实现前景背景分离,提出无需训练的框架利用预训练模型的中间表示进行分割。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02521 2026-05-14 cs.CV 79%

MooD: Perception-Enhanced Efficient Affective Image Editing via Continuous Valence-Arousal Modeling

MooD:通过连续的效价-唤醒建模提升的感知增强高效情感图像编辑

Xinyi Yin, Yiduo Wang, Tingqi Hu, Meicong Si, Yunyun Shi, Shi Chen, Hao Wang, Junxiao Xue, Xuecheng Wu

机构 * School of Cyber Science and Engineering, Zhengzhou University(郑州大学信息科学与工程学院) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) School of Journalism and New Media, Xi’an Jiaotong University(西安交通大学新闻与传播学院) Research Center for Space Computing System, Zhejiang Lab(浙江实验室空间计算系统研究中心)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 MooD通过连续效价-唤醒建模实现高效情感图像编辑,结合视觉迁移与感知增强的语义引导,提升情感可控性和视觉保真度,同时保持高效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07458 2026-05-14 cs.CV 79%

SpatialReward: Bridging the Perception Gap in Online RL for Image Editing via Explicit Spatial Reasoning

SpatialReward: 通过显式空间推理弥合在线强化学习中图像编辑的感知差距

Yancheng Long, Yankai Yang, Hongyang Wei, Wei Chen, Tianke Zhang, Haonan fan, Changyi Liu, Kaiyu Jiang, Jiankang Chen, Kaiyu Tang, Bin Wen, Fan Yang, Tingting Gao, Han Li, Shuo Yang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) The Hong Kong University of Science and Technology(香港科学与技术大学) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生学院,清华大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出SpatialReward,通过显式空间推理提升在线强化学习中图像编辑的感知准确性,其在MMRB2和EditReward-Bench上表现优异,并在MultiEditReward-Bench上超越专用评估器。

Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13062 2026-05-14 cs.CV 79%

Edit-Compass & EditReward-Compass: A Unified Benchmark for Image Editing and Reward Modeling

Edit-Compass 与 EditReward-Compass:图像编辑与奖励建模的统一基准

Xuehai Bai, Yang Shi, Yi-Fan Zhang, Xuanyu Zhu, Yuran Wang, Yifan Dai, Xinyu Liu, Yiyan Ji, Xiaoling Gu, Yuanxing Zhang

机构 * HDU(杭州大学) PKU(北京大学) Kling Team(Kling团队) CASIA(中国科学院自动化研究所)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出Edit-Compass和EditReward-Compass,通过精细多维评估框架和真实奖励建模场景,解决现有图像编辑和奖励模型评估中的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12724 2026-05-14 cs.CV cs.AI 79%

Inline Critic Steers Image Editing

内联批评引导图像编辑

Weitai Kang, Xiaohang Zhan, Yizhou Wang, Mang Tik Chiu, Jason Kuen, Kangning Liu, Yan Yan

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) Adobe

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出内联批评方法,通过在图像编辑过程中实时修正模型输出,提升生成质量,在多个基准测试中取得优异成绩。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1811.12784 2026-05-14 cs.CV 57%

The GAN that Warped: Semantic Attribute Editing with Unpaired Data

扭曲的GAN:无配对数据下的语义属性编辑

Gara Dorta, Sara Vicente, Neill D. F. Campbell, Ivor J. A. Simpson

机构 * University of Bath(巴斯大学) Anthropics Technology Ltd.(Anthropics技术有限公司) University of Sussex(苏塞克斯大学)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

AI总结 本文提出通过平滑扭曲场进行语义图像编辑,利用生成对抗网络在无配对数据下实现高分辨率人脸编辑,有效保持身份特征。

Comments CVPR 2020

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12826 2026-05-14 cs.CV cs.AI 57%

FRAME: Forensic Routing and Adaptive Multi-path Evidence Fusion for Image Manipulation Detection

FRAME:图像篡改检测的取证路由与自适应多路径证据融合

Kaixiang Zhao, Tianrun Yu, Aoxu Zhang, Junhao Su, Porter Jenkins, Amanda Hughes

机构 * Brigham Young University Rutgers University

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

AI总结 FRAME通过多路径分析空间整合多种取证算法,自适应选择信息量大的路径并融合互补证据,提升图像篡改检测与定位性能。

Comments Accepted to CVPR 2026 SAFE Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏