arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86585 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1264 篇

2510.13652 2025-10-16 cs.CV 57%

EditCast3D: Single-Frame-Guided 3D Editing with Video Propagation and View Selection

Huaizhi Qu, Ruichen Zhang, Shuqing Luo, Luchao Qi, Zhihao Zhang, Xiaoming Liu, Roni Sengupta, Tianlong Chen

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Michigan State University(密歇根州立大学)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06679 2025-10-09 cs.CV 57%

DreamOmni2: Multimodal Instruction-based Editing and Generation

Bin Xia, Bohao Peng, Yuechen Zhang, Junjia Huang, Jiyang Liu, Jingyao Li, Haoru Tan, Sitong Wu, Chengyao Wang, Yitong Wang, Xinglong Wu, Bei Yu, Jiaya Jia

机构 * CUHK(香港中文大学) HKUST(香港科技大学) HKU(香港大学) ByteDance Inc(字节跳动公司)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18538 2025-10-08 cs.CV 57%

GeoRemover: Removing Objects and Their Causal Visual Artifacts

Zixin Zhu, Haoxiang Li, Xuelu Feng, He Wu, Chunming Qiao, Junsong Yuan

机构 * University at Buffalo(布法罗大学) Pixocial Technology(Pixocial科技)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted as Spotlight at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01715 2025-10-03 cs.CV cs.AI 57%

PyramidStyler: Transformer-Based Neural Style Transfer with Pyramidal Positional Encoding and Reinforcement Learning

Raahul Krishna Durairaju, K. Saruladha

专题命中 图像编辑 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05424 2025-09-18 cs.LG cs.CV 57%

Locally Explaining Prediction Behavior via Gradual Interventions and Measuring Property Gradients

Niklas Penzel, Joachim Denzler

机构 * Computer Vision Group, Friedrich Schiller University Jena(耶拿弗里德里希·施勒尔大学计算机视觉组)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted at WACV-2026, 45 pages, 39 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08640 2025-09-11 eess.IV cs.AI cs.CV 57%

RoentMod: A Synthetic Chest X-Ray Modification Model to Identify and Correct Image Interpretation Model Shortcuts

Lauren H. Cooke, Matthias Jung, Jan M. Brendel, Nora M. Kerkovits, Borek Foldyna, Michael T. Lu, Vineet K. Raghu

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments 25 + 8 pages, 4 + 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08583 2025-09-11 cs.CV 57%

EfficientIML: Efficient High-Resolution Image Manipulation Localization

Jinhan Li, Haoyang He, Lei Xie, Jiangning Zhang

机构 * New York University(纽约大学) Zhejiang University(浙江大学)

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17315 2025-08-26 cs.CV 57%

Defending Deepfake via Texture Feature Perturbation

Xiao Zhang, Changfang Chen, Tianyi Wang

机构 * Key Laboratory of Computing Power Network and Information Security, Ministry of Education, Qilu University of Technology (Shandong Academy of Sciences)(计算机网络与信息安全重点实验室,教育部,齐鲁工业大学(山东省科学院)) Shandong Artificial Intelligence Institute, Qilu University of Technology (Shandong Academy of Sciences)(山东省人工智能研究院,齐鲁工业大学(山东省科学院)) School of Computing, National University of Singapore(新加坡国立大学计算机学院)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted to IEEE SMC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11961 2025-08-19 cs.CV 57%

PEdger++: Practical Edge Detection via Assembling Cross Information

Yuanbin Fu, Liang Li, Xiaojie Guo

机构 * College of Intelligence and Computing, Tianjin University(智能与计算学院,天津大学)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06080 2025-08-11 cs.CV 57%

DreamVE: Unified Instruction-based Image and Video Editing

Bin Xia, Jiyang Liu, Yuechen Zhang, Bohao Peng, Ruihang Chu, Yitong Wang, Xinglong Wu, Bei Yu, Jiaya Jia

机构 * CUHK(香港中文大学) ByteDance Inc(字节跳动公司) HKUST(香港理工大学)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13044 2025-08-08 cs.CV 57%

Magic Fixup: Streamlining Photo Editing by Watching Dynamic Videos

Hadi Alzayer, Zhihao Xia, Xuaner Zhang, Eli Shechtman, Jia-Bin Huang, Michael Gharbi

机构 * University of Maryland \& Adobe College Park MD USA Adobe San Jose CA USA Adobe Seattle CA USA Adobe San Francisco CA USA University of Maryland \& Adobe Adobe

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments ACM Transactions on Graphics 2025. Project page: https://magic-fixup.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03480 2025-08-06 cs.CV cs.AI 57%

VideoGuard: Protecting Video Content from Unauthorized Editing

Junjie Cao, Kaizhou Li, Xinchun Yu, Hongxiang Li, Xiaoping Zhang

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments ai security, 10pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01215 2025-08-05 cs.CV 57%

StyDeco: Unsupervised Style Transfer with Distilling Priors and Semantic Decoupling

Yuanlin Yang, Quanjian Song, Zhexian Gao, Ge Wang, Shanshan Li, Xiaoyan Zhang

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments 9 pages in total

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21033 2025-07-29 cs.CV 57%

GPT-IMAGE-EDIT-1.5M: A Million-Scale, GPT-Generated Image Dataset

Yuhan Wang, Siwei Yang, Bingchen Zhao, Letian Zhang, Qing Liu, Yuyin Zhou, Cihang Xie

机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校) The University of Edinburgh(爱丁堡大学) Adobe Project Page(Adobe项目页面)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16397 2025-07-23 cs.CV 57%

ADCD-Net: Robust Document Image Forgery Localization via Adaptive DCT Feature and Hierarchical Content Disentanglement

Kahim Wong, Jicheng Zhou, Haiwei Wu, Yain-Whar Si, Jiantao Zhou

机构 * State Key Laboratory of Internet of Things for Smart City, Department of Computer and Information Science, University of Macau(澳门大学物联网智能城市国家重点实验室,计算机与信息科学系) School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04243 2025-07-09 cs.CV cs.AI 57%

Domain Generalizable Portrait Style Transfer

Xinbo Wang, Wenju Xu, Qing Zhang, Wei-Shi Zheng

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments Accepted to ICCV2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03636 2025-07-08 cs.CR cs.CV 57%

SecureT2I: No More Unauthorized Manipulation on AI Generated Images from Prompts

Xiaodong Wu, Xiangman Li, Qi Li, Jianbing Ni, Rongxing Lu

机构 * Queen’s University(皇后大学)

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15033 2025-06-19 cs.CV 57%

Break Stylistic Sophon: Are We Really Meant to Confine the Imagination in Style Transfer?

Gary Song Yan, Yusen Zhang, Jinyu Zhao, Hao Zhang, Zhangping Yang, Guanye Xiong, Yanfei Liu, Tao Zhang, Yujie He, Siyuan Tian, Yao Gou, Min Li

机构 * ISAI Lab(ISAI实验室) Xi’an Institute of High-tech(西安高新技术研究院) Department of Basic Courses(基础课程部) Department of Computer Science(计算机科学部) Huazhong University of Science and Technology(华中科技大学) College of Science(科学学院) National University of Defence Technology(国防科技大学) Intelligent Game and Decision Lab(智能游戏与决策实验室)

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12661 2025-06-19 cs.CV 57%

EmoEdit: Evoking Emotions through Image Manipulation

Jingyuan Yang, Jiawei Feng, Weibin Luo, Dani Lischinski, Daniel Cohen-Or, Hui Huang

机构 * CSSE, Shenzhen University(深圳大学计算机科学与工程学院) The Hebrew University of Jerusalem(耶路撒冷希伯来大学) Tel Aviv University(特拉维夫大学)

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07713 2025-06-16 cs.CV cs.AI 57%

Consistent Video Editing as Flow-Driven Image-to-Video Generation

Ge Wang, Songlin Fan, Hangxu Liu, Quanjian Song, Hewei Wang, Jinfeng Xu

机构 * Fudan University(复旦大学) Xiamen University(厦门大学) Carnegie Mellon University(卡内基梅隆大学) The University of Hong Kong(香港大学)

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments 16 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07205 2025-06-10 cs.CV 57%

TV-LiVE: Training-Free, Text-Guided Video Editing via Layer Informed Vitality Exploitation

Min-Jung Kim, Dongjin Kim, Seokju Yun, Jaegul Choo

机构 * KAIST AI(韩国科学技术院人工智能研究所) University of Seoul(首尔大学)

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05858 2025-06-09 cs.CV 57%

ChronoTailor: Harnessing Attention Guidance for Fine-Grained Video Virtual Try-On

Jinjuan Wang, Wenzhang Sun, Ming Li, Yun Zheng, Fanyao Li, Zhulin Tao, Donglin Di, Hao Li, Wei Chen, Xianglin Huang

机构 * Communication University of China(中国传媒大学)

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17796 2025-05-26 cs.CV cs.AI cs.IR 57%

DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval

Yuxin Yang, Yinan Zhou, Yuxin Chen, Ziqi Zhang, Zongyang Ma, Chunfeng Yuan, Bing Li, Lin Song, Jun Gao, Peng Li, Weiming Hu

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments 20 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09326 2025-05-01 cs.GR cs.AI 57%

HeadEvolver: Text to Head Avatars via Expressive and Attribute-Preserving Mesh Deformation

Duotun Wang, Hengyu Meng, Zeyu Cai, Zhijing Shao, Qianxi Liu, Lin Wang, Mingming Fan, Xiaohang Zhan, Zeyu Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Tencent AI Lab(腾讯人工智能实验室)

专题命中 图像编辑 :diffusion(abstract);分类 cs.GR

Comments 13 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03629 2025-04-30 cs.CV cs.AI cs.CL cs.LG 57%

REALEDIT: Reddit Edits As a Large-scale Empirical Dataset for Image Transformations

Peter Sushko, Ayana Bharadwaj, Zhi Yang Lim, Vasily Ilin, Ben Caffee, Dongping Chen, Mohammadreza Salehi, Cheng-Yu Hsieh, Ranjay Krishna

机构 * University of Washington(华盛顿大学) Allen Institute for AI(人工智能研究院)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Published at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19212 2025-04-29 cs.CV cs.AI 57%

CapsFake: A Multimodal Capsule Network for Detecting Instruction-Guided Deepfakes

Tuan Nguyen, Naseem Khan, Issa Khalil

机构 * Qatar Computing Research Institute(卡塔尔计算研究所) Hamad Bin Khalifa University(哈马德·本·卡尔法大学)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10385 2025-04-15 cs.CV 57%

Mamba-ST: State Space Model for Efficient Style Transfer

Filippo Botti, Alex Ergasti, Leonardo Rossi, Tomaso Fontanini, Claudio Ferrari, Massimo Bertozzi, Andrea Prati

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07462 2025-04-11 cs.CV 57%

Learning Universal Features for Generalizable Image Forgery Localization

Hengrun Zhao, Yunzhi Zhuge, Yifan Wang, Lijun Wang, Huchuan Lu, Yu Zeng

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06481 2025-04-08 cs.CV 57%

NeIn: Telling What You Don't Want

Nhat-Tan Bui, Dinh-Hieu Hoang, Quoc-Huy Trinh, Minh-Triet Tran, Truong Nguyen, Susan Gauch

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted to CVPR 2025 Workshop SyntaGen. Project page: https://tanbuinhat.github.io/NeIn/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02801 2025-04-04 cs.CV 57%

F-ViTA: Foundation Model Guided Visible to Thermal Translation

Jay N. Paranjape, Celso de Melo, Vishal M. Patel

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏