arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1258 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1258 篇

2510.04290 2025-10-20 cs.CV 83%

ChronoEdit: Towards Temporal Reasoning for Image Editing and World Simulation

Jay Zhangjie Wu, Xuanchi Ren, Tianchang Shen, Tianshi Cao, Kai He, Yifan Lu, Ruiyuan Gao, Enze Xie, Shiyi Lan, Jose M. Alvarez, Jun Gao, Sanja Fidler, Zian Wang, Huan Ling

机构 * NVIDIA University of Toronto(多伦多大学)

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);分类 cs.CV

Comments Project Page: https://research.nvidia.com/labs/toronto-ai/chronoedit

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04483 2025-10-16 cs.CV 83%

TBStar-Edit: From Image Editing Pattern Shifting to Consistency Enhancement

Hao Fang, Zechao Zhan, Weixin Feng, Ziwei Huang, Xubin Li, Tiezheng Ge

机构 * Taobao & Tmall Group of Alibaba(阿里巴巴淘宝及天猫集团)

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15031 2025-10-08 cs.CV 83%

AutoEdit: Automatic Hyperparameter Tuning for Image Editing

Chau Pham, Quan Dao, Mahesh Bhosale, Yunjie Tian, Dimitris Metaxas, David Doermann

机构 * University at Buffalo(布法罗大学) Rutgers University(罗格斯大学)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments Provided code link

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04034 2025-10-07 cs.CV cs.AI 83%

Prompt-to-Prompt: Text-Based Image Editing Via Cross-Attention Mechanisms -- The Research of Hyperparameters and Novel Mechanisms to Enhance Existing Frameworks

Linn Bieske, Carla Lorente

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18159 2025-09-30 cs.CV cs.LG 83%

SpotEdit: Evaluating Visually-Guided Image Editing Methods

Sara Ghazanfari, Wei-An Lin, Haitong Tian, Ersin Yumer

机构 * New York University, US(纽约大学) Adobe Inc(Adobe公司)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21905 2025-09-29 cs.CV 83%

TDEdit: A Unified Diffusion Framework for Text-Drag Guided Image Manipulation

Qihang Wang, Yaxiong Wang, Lechao Cheng, Zhun Zhong

机构 * Hefei University of Technology(合肥工业大学)

专题命中 图像编辑 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11213 2025-09-16 cs.CV 83%

Beyond Sliders: Mastering the Art of Diffusion-based Image Manipulation

Yufei Tang, Daiheng Gao, Pingyu Wu, Wenbo Zhou, Bang Zhang, Weiming Zhang

机构 * FUYAO University Of Science And Technology(福尧大学科学技术学院) University of Science and Technology of China(中国科学技术大学) Anhui Province Key Laboratory of Digital Security(安徽省数字安全重点实验室) Alibaba TongYi Lab(阿里巴巴通义实验室)

专题命中 图像编辑 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 6 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17435 2025-08-26 cs.CV 83%

An LLM-LVLM Driven Agent for Iterative and Fine-Grained Image Editing

Zihan Liang, Jiahao Sun, Haoran Ma

机构 * Kunming University of Science and Technology(昆明理工大学)

专题命中 图像编辑 :image editing(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06101 2025-08-11 cs.CV 83%

UGD-IML: A Unified Generative Diffusion-based Framework for Constrained and Unconstrained Image Manipulation Localization

Yachun Mi, Xingyang He, Shixin Sun, Yu Li, Yanting Li, Zhixuan Li, Jian Jin, Chen Hui, Shaohui Liu

专题命中 图像编辑 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17894 2025-08-04 cs.CV 83%

DCT-Shield: A Robust Frequency Domain Defense against Malicious Image Editing

Aniruddha Bala, Rohit Chowdhury, Rohan Jaiswal, Siddharth Roheda

机构 * Samsung R&D Institute(三星研发研究所)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17761 2025-08-01 cs.CV 83%

Step1X-Edit: A Practical Framework for General Image Editing

Shiyu Liu, Yucheng Han, Peng Xing, Fukun Yin, Rui Wang, Wei Cheng, Jiaqi Liao, Yingming Wang, Honghao Fu, Chunrui Han, Guopeng Li, Yuang Peng, Quan Sun, Jingwei Wu, Yan Cai, Zheng Ge, Ranchen Ming, Lei Xia, Xianfang Zeng, Yibo Zhu, Binxing Jiao, Xiangyu Zhang, Gang Yu, Daxin Jiang

机构 * Step1X-Image Team(Step1X-图像团队)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments code: https://github.com/stepfun-ai/Step1X-Edit

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23145 2025-07-29 cs.CV cs.AI cs.LG 83%

FlowAlign: Trajectory-Regularized, Inversion-Free Flow-based Image Editing

Jeongsol Kim, Yeobin Hong, Jonghyun Park, Jong Chul Ye

机构 * KAIST(韩国科学技术院)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16240 2025-07-23 cs.CV 83%

Scale Your Instructions: Enhance the Instruction-Following Fidelity of Unified Image Generation Model by Self-Adaptive Attention Scaling

Chao Zhou, Tianyi Wei, Nenghai Yu

机构 * University of Science and Technology of China(中国科学技术大学) Nanyang Technological University(南洋理工大学)

专题命中 图像编辑 :image generation(title,abstract);image editing(abstract);分类 cs.CV

Comments Accept by ICCV2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12429 2025-07-15 cs.CV 83%

FlexEdit: Marrying Free-Shape Masks to VLLM for Flexible Image Editing

Tianshuo Yuan, Yuxiang Lin, Jue Wang, Zhi-Qi Cheng, Xiaolong Wang, Jiao GH, Wei Chen, Xiaojiang Peng

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments 15 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18116 2025-07-09 cs.CV cs.AI cs.CL 83%

Bayesian Optimization for Controlled Image Editing via LLMs

Chengkun Cai, Haoliang Liu, Xu Zhao, Zhongyu Jiang, Tianfang Zhang, Zongkai Wu, John Lee, Jenq-Neng Hwang, Lei Li

机构 * University of Edinburgh(爱丁堡大学) University of Manchester(曼彻斯特大学) University of Washington(华盛顿大学) Tsinghua University(清华大学) Skai Intelligence(Skai智能科技) University of Copenhagen(哥本哈根大学)

专题命中 图像编辑 :image editing(title,abstract);image generation(abstract);分类 cs.CV

Comments 8 figures, accept at ACL2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05259 2025-07-08 cs.CV 83%

Beyond Simple Edits: X-Planner for Complex Instruction-Based Image Editing

Chun-Hsiao Yeh, Yilin Wang, Nanxuan Zhao, Richard Zhang, Yuheng Li, Yi Ma, Krishna Kumar Singh

机构 * UC Berkeley(伯克利大学) HKU(香港大学) Adobe(Adobe公司)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments Project page: https://danielchyeh.github.io/x-planner/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19103 2025-06-25 cs.CV 83%

Inverse-and-Edit: Effective and Fast Image Editing by Cycle Consistency Models

Ilia Beletskii, Andrey Kuznetsov, Aibek Alanov

机构 * HSE University(俄罗斯高等经济大学) AIRI(人工智能研究院) Sber(俄罗斯储蓄银行) Innopolis

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments The code of our method is available on GitHub at https://github.com/ControlGenAI/Inverse-and-Edit

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03107 2025-06-12 cs.CV 83%

ByteMorph: Benchmarking Instruction-Guided Image Editing with Non-Rigid Motions

Di Chang, Mingdeng Cao, Yichun Shi, Bo Liu, Shengqu Cai, Shijie Zhou, Weilin Huang, Gordon Wetzstein, Mohammad Soleymani, Peng Wang

机构 * ByteDance Seed(字节跳动种子) University of Southern California(南加州大学) University of Tokyo(东京大学) University of California Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学) University of California Los Angeles(加州大学洛杉矶分校)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments Website: https://boese0601.github.io/bytemorph Dataset: https://huggingface.co/datasets/ByteDance-Seed/BM-6M Benchmark: https://huggingface.co/datasets/ByteDance-Seed/BM-Bench Code: https://github.com/ByteDance-Seed/BM-code Demo: https://huggingface.co/spaces/Boese0601/ByteMorph-Demo

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05083 2025-06-09 cs.CV 83%

SeedEdit 3.0: Fast and High-Quality Generative Image Editing

Peng Wang, Yichun Shi, Xiaochen Lian, Zhonghua Zhai, Xin Xia, Xuefeng Xiao, Weilin Huang, Jianchao Yang

机构 * ByteDance(字节跳动)

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments Website: https://seed.bytedance.com/tech/seededit

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11753 2025-05-20 cs.CV 83%

X-Edit: Detecting and Localizing Edits in Images Altered by Text-Guided Diffusion Models

Valentina Bazyleva, Nicolo Bonettini, Gaurav Bharaj

机构 * Reality Defender

专题命中 图像编辑 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

Comments CVPR (XAI4CV) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07199 2025-04-29 cs.CV cs.AI 83%

OmniEdit: Building Image Editing Generalist Models Through Specialist Supervision

Cong Wei, Zheyang Xiong, Weiming Ren, Xinrun Du, Ge Zhang, Wenhu Chen

机构 * University of Waterloo(滑铁卢大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Vector Institute(向量研究所) M-A-P

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02828 2025-04-04 cs.CV cs.AI cs.CL 83%

Concept Lancet: Image Editing with Compositional Representation Transplant

Jinqi Luo, Tianjiao Ding, Kwan Ho Ryan Chan, Hancheng Min, Chris Callison-Burch, René Vidal

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted in CVPR 2025. Project page at https://peterljq.github.io/project/colan

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23897 2025-04-01 cs.CV cs.AI 83%

Training-Free Text-Guided Image Editing with Visual Autoregressive Model

Yufei Wang, Lanqing Guo, Zhihao Li, Jiaxing Huang, Pichao Wang, Bihan Wen, Jian Wang

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19839 2025-04-01 cs.CV 83%

FireEdit: Fine-grained Instruction-based Image Editing via Region-aware Vision Language Model

Jun Zhou, Jiahao Li, Zunnan Xu, Hanhui Li, Yiji Cheng, Fa-Ting Hong, Qin Lin, Qinglin Lu, Xiaodan Liang

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15738 2025-04-01 cs.CV 83%

AnyEdit: Mastering Unified High-Quality Image Editing for Any Idea

Qifan Yu, Wei Chow, Zhongqi Yue, Kaihang Pan, Yang Wu, Xiaoyang Wan, Juncheng Li, Siliang Tang, Hanwang Zhang, Yueting Zhuang

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21541 2025-03-31 cs.CV cs.AI 83%

LOCATEdit: Graph Laplacian Optimized Cross Attention for Localized Text-Guided Image Editing

Achint Soni, Meet Soni, Sirisha Rambhatla

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15843 2025-03-26 cs.CV cs.LG 83%

Unveil Inversion and Invariance in Flow Transformer for Versatile Image Editing

Pengcheng Xu, Boyuan Jiang, Xiaobin Hu, Donghao Luo, Qingdong He, Jiangning Zhang, Chengjie Wang, Yunsheng Wu, Charles Ling, Boyu Wang

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments CVPR 2025 Page: https://pengchengpcx.github.io/EditFT/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17593 2025-03-25 cs.CV 83%

Guidance Free Image Editing via Explicit Conditioning

Mehdi Noroozi, Alberto Gil Ramos, Luca Morreale, Ruchika Chavhan, Malcolm Chadwick, Abhinav Mehrotra, Sourav Bhattacharya

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09703 2025-03-25 cs.CV 83%

MagicQuill: An Intelligent Interactive Image Editing System

Zichen Liu, Yue Yu, Hao Ouyang, Qiuyu Wang, Ka Leong Cheng, Wen Wang, Zhiheng Liu, Qifeng Chen, Yujun Shen

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

Comments Accepted to CVPR 2025. Code and demo available at https://magic-quill.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16795 2025-03-24 cs.CV 83%

DCEdit: Dual-Level Controlled Image Editing via Precisely Localized Semantics

Yihan Hu, Jianing Peng, Yiheng Lin, Ting Liu, Xiaochao Qu, Luoqi Liu, Yao Zhao, Yunchao Wei

专题命中 图像编辑 :image editing(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏