arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1258 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1258 篇

2501.12289 2025-12-24 cs.CV cs.AI cs.HC 79%

Regressor-Guided Generative Image Editing Balances User Emotions to Reduce Time Spent Online

回归引导的生成图像编辑通过平衡用户情绪以减少在线时间

Christoph Gebhardt, Robin Willardt, Seyedmorteza Sadat, Chih-Wei Ning, Andreas Brombach, Jie Song, Otmar Hilliges, Christian Holz

机构 * Eastern Switzerland University of Applied Sciences \& ETH Z\"urich St.Gallen Switzerland ETH Z\"urich Z\"urich Switzerland The Hong Kong University of Science Eastern Switzerland University of Applied Sciences \& ETH Z\"urich ETH Z\"urich

专题命中 图像编辑 :image editing(title);diffusion(abstract);分类 cs.CV

AI总结 本文提出回归引导的生成图像编辑方法,通过调节图像情感影响以非强制性减少用户在线时间,实验表明该方法能平衡情绪反应并降低使用时长。

Comments 44 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00387 2025-12-09 cs.CV 79%

WiseEdit: Benchmarking Cognition- and Creativity-Informed Image Editing

WiseEdit: 图像编辑的认知与创造力导向基准测试

Kaihang Pan, Weile Chen, Haiyi Qiu, Qifan Yu, Wendong Bu, Zehan Wang, Yun Zhu, Juncheng Li, Siliang Tang

机构 * Zhejiang University(浙江大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 WiseEdit通过分解图像编辑为意识、解释和想象三个步骤,结合三种知识类型,全面评估图像编辑的认知与创造力能力。

Comments 32 pages, 20 figures. Project Page: https://qnancy.github.io/wiseedit_project_page/. Benchmark: https://huggingface.co/datasets/123123chen/WiseEdit-Benchmark/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23240 2025-12-01 cs.CV 79%

Autoregressive Styled Text Image Generation, but Make it Reliable

自回归风格文本图像生成,但使其更可靠

Carmine Zaccagnino, Fabio Quattrini, Vittorio Pippi, Silvia Cascianelli, Alessio Tonioni, Rita Cucchiara

机构 * University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学) Google(谷歌)

专题命中 图像编辑 :image generation(title);image editing(abstract);分类 cs.CV

AI总结 本文提出Eruku方法,通过多模态提示条件生成任务和分类器自由引导策略,改进自回归模型以生成更可靠、更忠实于文本提示的风格化文本图像。

Comments Accepted at WACV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05306 2025-11-07 cs.CV 79%

CREA: A Collaborative Multi-Agent Framework for Creative Image Editing and Generation

Kavana Venkatesh, Connor Dunlop, Pinar Yanardag

机构 * Virginia Tech(弗吉尼亚理工学院)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

Comments Published at NeurIPS'25 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01894 2025-11-05 cs.GR cs.AI cs.LG 79%

LGCC: Enhancing Flow Matching Based Text-Guided Image Editing with Local Gaussian Coupling and Context Consistency

Fangbing Liu, Pengfei Duan, Wen Li, Yi He

专题命中 图像编辑 :image editing(title,abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25590 2025-10-30 cs.CV cs.AI 79%

RegionE: Adaptive Region-Aware Generation for Efficient Image Editing

Pengtao Chen, Xianfang Zeng, Maosen Zhao, Mingzhu Shen, Peng Ye, Bangyin Xiang, Zhibo Wang, Wei Cheng, Gang Yu, Tao Chen

机构 * Fudan University(复旦大学) StepFun Imperial College London(伦敦帝国学院)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

Comments 26 pages, 10 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19808 2025-10-23 cs.CV cs.CL cs.LG 79%

Pico-Banana-400K: A Large-Scale Dataset for Text-Guided Image Editing

Yusu Qian, Eli Bocek-Rivele, Liangchen Song, Jialing Tong, Yinfei Yang, Jiasen Lu, Wenze Hu, Zhe Gan

机构 * Apple(苹果公司)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11863 2025-10-17 cs.CV 79%

SphereDrag: Spherical Geometry-Aware Panoramic Image Editing

Zhiao Feng, Xuewei Li, Junjie Yang, Jingchao Li, Yuxin Peng, Xi Li

机构 * School of Electronic and Information Engineering, Shanghai DianJi University(电子信息学院,上海电力大学) Department of Sports Science, Zhejiang University(体育学院,浙江大学) College of Computer Science and Technology, Zhejiang University(计算机科学与技术学院,浙江大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

Comments Accepted by PRCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08157 2025-10-10 cs.CV 79%

Beyond Textual CoT: Interleaved Text-Image Chains with Deep Confidence Reasoning for Image Editing

Zhentao Zou, Zhengrong Yue, Kunpeng Du, Binlei Bao, Hanting Li, Haizhen Xie, Guozheng Xu, Yue Zhou, Yali Wang, Jie Hu, Xue Jiang, Xinghao Chen

机构 * Shanghai Jiaotong University(上海交通大学) Huawei Noah’s Ark Lab(华为诺亚实验室) East China Normal University(华东师范大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

Comments 25pages,20figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01921 2025-10-07 cs.CV cs.AI 79%

MedEBench: Diagnosing Reliability in Text-Guided Medical Image Editing

Minghao Liu, Zhitao He, Zhiyuan Fan, Qingyun Wang, Yi R. Fung

机构 * Hong Kong University of Science and Technology(香港科技大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

Comments Project website: https://mliuby.github.io/MedEBench_Website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19731 2025-10-03 cs.CV 79%

CAMILA: Context-Aware Masking for Image Editing with Language Alignment

Hyunseung Kim, Chiho Choi, Srikanth Malla, Sai Prahladh Padmanabhan, Saurabh Bagchi, Joon Hee Choi

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24900 2025-09-30 cs.CV cs.AI 79%

OpenGPT-4o-Image: A Comprehensive Dataset for Advanced Image Generation and Editing

Zhihong Chen, Xuehai Bai, Yang Shi, Chaoyou Fu, Huanyu Zhang, Haotian Wang, Xiaoyan Sun, Zhang Zhang, Liang Wang, Yuanxing Zhang, Pengfei Wan, Yi-Fan Zhang

机构 * USTC(中国科学技术大学) Kling Team(Kling团队) HDU(华中科技大学) PKU(北京大学) NJU(南京大学) CASIA(中国科学院自动化研究所) THU(清华大学)

专题命中 图像编辑 :image generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24514 2025-09-30 cs.CV 79%

Instruction Guided Multi Object Image Editing with Quantity and Layout Consistency

Jiaqi Tan, Fangyu Li, Yang Liu

机构 * Beijing University of Posts(北京邮电大学) Telecommunications School of Digital Media(电信数字媒体学院)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15216 2025-09-29 cs.CV 79%

UIP2P: Unsupervised Instruction-based Image Editing via Edit Reversibility Constraint

Enis Simsar, Alessio Tonioni, Yongqin Xian, Thomas Hofmann, Federico Tombari

机构 * ETH Zürich - DALAB(苏黎世联邦理工学院- DALAB) Technical University of Munich(慕尼黑技术大学) Google Switzerland(瑞士谷歌)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

Comments Accepted to ICCV'25. Project page: https://uip2p.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14119 2025-09-26 cs.CV cs.AI cs.CL cs.LG 79%

NoHumansRequired: Autonomous High-Quality Image Editing Triplet Mining

Maksim Kuprashevich, Grigorii Alekseenko, Irina Tolstykh, Georgii Fedorov, Bulat Suleimanov, Vladimir Dokholyan, Aleksandr Gordeev

机构 * R&D Department, SALUTEDEV(SALUTEDEV 研发部)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14638 2025-09-19 cs.CV 79%

MultiEdit: Advancing Instruction-based Image Editing on Diverse and Challenging Tasks

Mingsong Li, Lin Liu, Hongjun Wang, Haoxing Chen, Xijun Gu, Shizhan Liu, Dong Gong, Junbo Zhao, Zhenzhong Lan, Jianguo Li

机构 * University of New South Wales(新南威尔士大学) The University of Hong Kong(香港大学) Zhejiang University(浙江大学) Westlake University(西湖大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16360 2025-09-19 cs.CV cs.LG 79%

Style Transfer with Diffusion Models for Synthetic-to-Real Domain Adaptation

Estelle Chigot, Dennis G. Wilson, Meriem Ghrib, Thomas Oberlin

机构 * ISAE-Supaero, University of Toulouse, France(ISAE-苏帕埃罗大学、图卢兹大学、法国) Airbus, France(空客公司、法国)

专题命中 图像编辑 :diffusion(title,abstract);分类 cs.CV

Comments Published in Computer Vision and Image Understanding, September 2025 (CVIU 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12883 2025-09-17 cs.CV 79%

Lego-Edit: A General Image Editing Framework with Model-Level Bricks and MLLM Builder

Qifei Jia, Yu Liu, Yajie Chai, Xintong Yao, Qiming Lu, Yasen Zhang, Runyu Shi, Ying Huang, Guoquan Zhang

机构 * Xiaomi Corporation Beijing, China(小米公司北京)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10359 2025-09-15 cs.CV 79%

Immunizing Images from Text to Image Editing via Adversarial Cross-Attention

Matteo Trippodo, Federico Becattini, Lorenzo Seidenari

机构 * University of Florence(佛罗伦萨大学) University of Siena(锡耶纳大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

Comments Accepted as Regular Paper at ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07317 2025-07-29 cs.CV 79%

ADIEE: Automatic Dataset Creation and Scorer for Instruction-Guided Image Editing Evaluation

Sherry X. Chen, Yi Wei, Luowei Zhou, Suren Kumar

机构 * Samsung AI Center(三星AI中心) Mountain View University of California, Santa Barbara(山景城加州大学圣巴巴拉分校)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

Comments International Conference on Computer Vision (ICCV) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14024 2025-07-21 cs.CV 79%

Moodifier: MLLM-Enhanced Emotion-Driven Image Editing

Jiarong Ye, Sharon X. Huang

机构 * The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02358 2025-07-14 cs.CV cs.AI 79%

Hita: Holistic Tokenizer for Autoregressive Image Generation

Anlin Zheng, Haochen Wang, Yucheng Zhao, Weipeng Deng, Tiancai Wang, Xiangyu Zhang, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) NLPR, MAIS, CASIA(国家工程研究中心、人工智能院、中国科学院) Dexmal StepFun MEGVII Techonology(MEGVII科技)

专题命中 图像编辑 :image generation(title,abstract);分类 cs.CV

Comments 17 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13327 2025-07-02 cs.CV 79%

Edit Transfer: Learning Image Editing via Vision In-Context Relations

Lan Chen, Qi Mao, Yuchao Gu, Mike Zheng Shou

机构 * MIPG, Communication University of China(通信大学) Show Lab, National University of Singapore(新加坡国立大学)

专题命中 图像编辑 :image editing(title);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05769 2025-07-02 cs.CV 79%

Exploring Text-Guided Single Image Editing for Remote Sensing Images

Fangzhou Han, Lingyu Si, Zhizhuo Jiang, Hongwei Dong, Lamei Zhang, Yu Liu, Hao Chen, Bo Du

机构 * Department of Information Engineering, Harbin Institute of Technology(信息工程系,哈尔滨工业大学) National Key Laboratory of Space Integrated Information System, Institute of Software, Chinese Academy of Sciences(空间信息集成国家重点实验室,中国科学院软件研究所) Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学) Hubei Luojia Laboratory, National Engineering Research Center for Multimedia Software, School of Computer Science, Wuhan University(湖北珞珈实验室,国家多媒体软件工程技术研究中心,武汉大学计算机学院)

专题命中 图像编辑 :image editing(title);image generation(abstract);分类 cs.CV

Comments 17 pages, 18 figures, Accepted by IEEE Journal of Selected Topics in Applied Earth Observations and Remote Sensing

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20911 2025-06-27 cs.CV 79%

FaSTA$^*$: Fast-Slow Toolpath Agent with Subroutine Mining for Efficient Multi-turn Image Editing

Advait Gupta, Rishie Raj, Dang Nguyen, Tianyi Zhou

机构 * University of Maryland, College Park(马里兰大学 College Park分校)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12830 2025-06-17 cs.CV 79%

ComplexBench-Edit: Benchmarking Complex Instruction-Driven Image Editing via Compositional Dependencies

Chenglin Wang, Yucheng Zhou, Qianning Wang, Zhe Wang, Kai Zhang

机构 * East China Normal University(东华大学) University of Macau(澳门大学) Auckland University of Technology(奥克兰理工大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

Comments 7 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05466 2025-06-13 cs.CV 79%

Towards Reliable Identification of Diffusion-based Image Manipulations

Alex Costanzino, Woody Bayliss, Juil Sock, Marc Gorriz Blanch, Danijela Horak, Ivan Laptev, Philip Torr, Fabio Pizzati

机构 * University of Bologna(博洛尼亚大学) BBC AI(BBC人工智能部门) MBZUAI(马克斯·普朗克人工智能研究所) University of Oxford(牛津大学)

专题命中 图像编辑 :diffusion(title,abstract);分类 cs.CV

Comments Project page at https://alex-costanzino.github.io/radar/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03448 2025-06-05 cs.CV 79%

RefEdit: A Benchmark and Method for Improving Instruction-based Image Editing Model on Referring Expressions

Bimsara Pathiraja, Maitreya Patel, Shivam Singh, Yezhou Yang, Chitta Baral

机构 * Arizona State University(亚利桑那州立大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

Comments Project page: \url{http://refedit.vercel.app}

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19352 2025-05-27 cs.CV 79%

Beyond Editing Pairs: Fine-Grained Instructional Image Editing via Multi-Scale Learnable Regions

Chenrui Ma, Xi Xiao, Tianyang Wang, Yanning Shen

机构 * Department of Electronic Engineering and Computer Science University of California, Irvine(电子工程与计算机科学系 加州大学尔湾分校) Department of Computer Science University of Alabama at Birmingham(计算机科学系 阿拉巴马大学伯明翰分校)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16181 2025-05-27 cs.CV cs.AI 79%

Understanding Generative AI Capabilities in Everyday Image Editing Tasks

Mohammad Reza Taesiri, Brandon Collins, Logan Bolton, Viet Dac Lai, Franck Dernoncourt, Trung Bui, Anh Totti Nguyen

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

Comments Code and qualitative examples are available at: https://psrdataset.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏