arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1258 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1258 篇

2508.17315 2025-08-26 cs.CV 57%

Defending Deepfake via Texture Feature Perturbation

Xiao Zhang, Changfang Chen, Tianyi Wang

机构 * Key Laboratory of Computing Power Network and Information Security, Ministry of Education, Qilu University of Technology (Shandong Academy of Sciences)(计算机网络与信息安全重点实验室,教育部,齐鲁工业大学(山东省科学院)) Shandong Artificial Intelligence Institute, Qilu University of Technology (Shandong Academy of Sciences)(山东省人工智能研究院,齐鲁工业大学(山东省科学院)) School of Computing, National University of Singapore(新加坡国立大学计算机学院)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted to IEEE SMC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11961 2025-08-19 cs.CV 57%

PEdger++: Practical Edge Detection via Assembling Cross Information

Yuanbin Fu, Liang Li, Xiaojie Guo

机构 * College of Intelligence and Computing, Tianjin University(智能与计算学院,天津大学)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06080 2025-08-11 cs.CV 57%

DreamVE: Unified Instruction-based Image and Video Editing

Bin Xia, Jiyang Liu, Yuechen Zhang, Bohao Peng, Ruihang Chu, Yitong Wang, Xinglong Wu, Bei Yu, Jiaya Jia

机构 * CUHK(香港中文大学) ByteDance Inc(字节跳动公司) HKUST(香港理工大学)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13044 2025-08-08 cs.CV 57%

Magic Fixup: Streamlining Photo Editing by Watching Dynamic Videos

Hadi Alzayer, Zhihao Xia, Xuaner Zhang, Eli Shechtman, Jia-Bin Huang, Michael Gharbi

机构 * University of Maryland \& Adobe College Park MD USA Adobe San Jose CA USA Adobe Seattle CA USA Adobe San Francisco CA USA University of Maryland \& Adobe Adobe

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments ACM Transactions on Graphics 2025. Project page: https://magic-fixup.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03480 2025-08-06 cs.CV cs.AI 57%

VideoGuard: Protecting Video Content from Unauthorized Editing

Junjie Cao, Kaizhou Li, Xinchun Yu, Hongxiang Li, Xiaoping Zhang

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments ai security, 10pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01334 2025-08-06 cs.CV 57%

Zero-shot Segmentation of Skin Conditions: Erythema with Edit-Friendly Inversion

Konstantinos Moutselos, Ilias Maglogiannis

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01215 2025-08-05 cs.CV 57%

StyDeco: Unsupervised Style Transfer with Distilling Priors and Semantic Decoupling

Yuanlin Yang, Quanjian Song, Zhexian Gao, Ge Wang, Shanshan Li, Xiaoyan Zhang

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments 9 pages in total

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21033 2025-07-29 cs.CV 57%

GPT-IMAGE-EDIT-1.5M: A Million-Scale, GPT-Generated Image Dataset

Yuhan Wang, Siwei Yang, Bingchen Zhao, Letian Zhang, Qing Liu, Yuyin Zhou, Cihang Xie

机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校) The University of Edinburgh(爱丁堡大学) Adobe Project Page(Adobe项目页面)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16397 2025-07-23 cs.CV 57%

ADCD-Net: Robust Document Image Forgery Localization via Adaptive DCT Feature and Hierarchical Content Disentanglement

Kahim Wong, Jicheng Zhou, Haiwei Wu, Yain-Whar Si, Jiantao Zhou

机构 * State Key Laboratory of Internet of Things for Smart City, Department of Computer and Information Science, University of Macau(澳门大学物联网智能城市国家重点实验室,计算机与信息科学系) School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04243 2025-07-09 cs.CV cs.AI 57%

Domain Generalizable Portrait Style Transfer

Xinbo Wang, Wenju Xu, Qing Zhang, Wei-Shi Zheng

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments Accepted to ICCV2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03636 2025-07-08 cs.CR cs.CV 57%

SecureT2I: No More Unauthorized Manipulation on AI Generated Images from Prompts

Xiaodong Wu, Xiangman Li, Qi Li, Jianbing Ni, Rongxing Lu

机构 * Queen’s University(皇后大学)

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15033 2025-06-19 cs.CV 57%

Break Stylistic Sophon: Are We Really Meant to Confine the Imagination in Style Transfer?

Gary Song Yan, Yusen Zhang, Jinyu Zhao, Hao Zhang, Zhangping Yang, Guanye Xiong, Yanfei Liu, Tao Zhang, Yujie He, Siyuan Tian, Yao Gou, Min Li

机构 * ISAI Lab(ISAI实验室) Xi’an Institute of High-tech(西安高新技术研究院) Department of Basic Courses(基础课程部) Department of Computer Science(计算机科学部) Huazhong University of Science and Technology(华中科技大学) College of Science(科学学院) National University of Defence Technology(国防科技大学) Intelligent Game and Decision Lab(智能游戏与决策实验室)

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12661 2025-06-19 cs.CV 57%

EmoEdit: Evoking Emotions through Image Manipulation

Jingyuan Yang, Jiawei Feng, Weibin Luo, Dani Lischinski, Daniel Cohen-Or, Hui Huang

机构 * CSSE, Shenzhen University(深圳大学计算机科学与工程学院) The Hebrew University of Jerusalem(耶路撒冷希伯来大学) Tel Aviv University(特拉维夫大学)

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07713 2025-06-16 cs.CV cs.AI 57%

Consistent Video Editing as Flow-Driven Image-to-Video Generation

Ge Wang, Songlin Fan, Hangxu Liu, Quanjian Song, Hewei Wang, Jinfeng Xu

机构 * Fudan University(复旦大学) Xiamen University(厦门大学) Carnegie Mellon University(卡内基梅隆大学) The University of Hong Kong(香港大学)

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments 16 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07205 2025-06-10 cs.CV 57%

TV-LiVE: Training-Free, Text-Guided Video Editing via Layer Informed Vitality Exploitation

Min-Jung Kim, Dongjin Kim, Seokju Yun, Jaegul Choo

机构 * KAIST AI(韩国科学技术院人工智能研究所) University of Seoul(首尔大学)

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05858 2025-06-09 cs.CV 57%

ChronoTailor: Harnessing Attention Guidance for Fine-Grained Video Virtual Try-On

Jinjuan Wang, Wenzhang Sun, Ming Li, Yun Zheng, Fanyao Li, Zhulin Tao, Donglin Di, Hao Li, Wei Chen, Xianglin Huang

机构 * Communication University of China(中国传媒大学)

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17796 2025-05-26 cs.CV cs.AI cs.IR 57%

DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval

Yuxin Yang, Yinan Zhou, Yuxin Chen, Ziqi Zhang, Zongyang Ma, Chunfeng Yuan, Bing Li, Lin Song, Jun Gao, Peng Li, Weiming Hu

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments 20 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09326 2025-05-01 cs.GR cs.AI 57%

HeadEvolver: Text to Head Avatars via Expressive and Attribute-Preserving Mesh Deformation

Duotun Wang, Hengyu Meng, Zeyu Cai, Zhijing Shao, Qianxi Liu, Lin Wang, Mingming Fan, Xiaohang Zhan, Zeyu Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Tencent AI Lab(腾讯人工智能实验室)

专题命中 图像编辑 :diffusion(abstract);分类 cs.GR

Comments 13 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03629 2025-04-30 cs.CV cs.AI cs.CL cs.LG 57%

REALEDIT: Reddit Edits As a Large-scale Empirical Dataset for Image Transformations

Peter Sushko, Ayana Bharadwaj, Zhi Yang Lim, Vasily Ilin, Ben Caffee, Dongping Chen, Mohammadreza Salehi, Cheng-Yu Hsieh, Ranjay Krishna

机构 * University of Washington(华盛顿大学) Allen Institute for AI(人工智能研究院)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Published at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19212 2025-04-29 cs.CV cs.AI 57%

CapsFake: A Multimodal Capsule Network for Detecting Instruction-Guided Deepfakes

Tuan Nguyen, Naseem Khan, Issa Khalil

机构 * Qatar Computing Research Institute(卡塔尔计算研究所) Hamad Bin Khalifa University(哈马德·本·卡尔法大学)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10385 2025-04-15 cs.CV 57%

Mamba-ST: State Space Model for Efficient Style Transfer

Filippo Botti, Alex Ergasti, Leonardo Rossi, Tomaso Fontanini, Claudio Ferrari, Massimo Bertozzi, Andrea Prati

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07462 2025-04-11 cs.CV 57%

Learning Universal Features for Generalizable Image Forgery Localization

Hengrun Zhao, Yunzhi Zhuge, Yifan Wang, Lijun Wang, Huchuan Lu, Yu Zeng

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06481 2025-04-08 cs.CV 57%

NeIn: Telling What You Don't Want

Nhat-Tan Bui, Dinh-Hieu Hoang, Quoc-Huy Trinh, Minh-Triet Tran, Truong Nguyen, Susan Gauch

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted to CVPR 2025 Workshop SyntaGen. Project page: https://tanbuinhat.github.io/NeIn/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02801 2025-04-04 cs.CV 57%

F-ViTA: Foundation Model Guided Visible to Thermal Translation

Jay N. Paranjape, Celso de Melo, Vishal M. Patel

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21277 2025-04-02 cs.CV 57%

Zero-Shot Visual Concept Blending Without Text Guidance

Hiroya Makino, Takahiro Yamaguchi, Hiroyuki Sakai

专题命中 图像编辑 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22344 2025-03-31 cs.CV 57%

Semantix: An Energy Guided Sampler for Semantic Style Transfer

Huiang He, Minghui Hu, Chuanxia Zheng, Chaoyue Wang, Tat-Jen Cham

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments 28 pages, 19 figures, Accepted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02700 2025-03-31 cs.CV 57%

Motion Prompting: Controlling Video Generation with Motion Trajectories

Daniel Geng, Charles Herrmann, Junhwa Hur, Forrester Cole, Serena Zhang, Tobias Pfaff, Tatiana Lopez-Guevara, Carl Doersch, Yusuf Aytar, Michael Rubinstein, Chen Sun, Oliver Wang, Andrew Owens, Deqing Sun

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments CVPR 2025 camera ready. Project page: https://motion-prompting.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08503 2025-03-28 cs.CV 57%

StyleStudio: Text-Driven Style Transfer with Selective Control of Style Elements

Mingkun Lei, Xue Song, Beier Zhu, Hao Wang, Chi Zhang

专题命中 图像编辑 :text-to-image(abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01107 2025-03-28 cs.CV 57%

VideoHandles: Editing 3D Object Compositions in Videos Using Video Generative Priors

Juil Koo, Paul Guerrero, Chun-Hao Paul Huang, Duygu Ceylan, Minhyuk Sung

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Project page: https://videohandles.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17641 2025-03-25 cs.CV 57%

InstructVEdit: A Holistic Approach for Instructional Video Editing

Chi Zhang, Chengjian Feng, Feng Yan, Qiming Zhang, Mingjin Zhang, Yujie Zhong, Jing Zhang, Lin Ma

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments https://o937-blip.github.io/InstructVEdit

详情

展开后加载摘要…

URL PDF HTML 收藏