arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86585 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1264 篇

2503.21277 2025-04-02 cs.CV 57%

Zero-Shot Visual Concept Blending Without Text Guidance

Hiroya Makino, Takahiro Yamaguchi, Hiroyuki Sakai

专题命中 图像编辑 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22344 2025-03-31 cs.CV 57%

Semantix: An Energy Guided Sampler for Semantic Style Transfer

Huiang He, Minghui Hu, Chuanxia Zheng, Chaoyue Wang, Tat-Jen Cham

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments 28 pages, 19 figures, Accepted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02700 2025-03-31 cs.CV 57%

Motion Prompting: Controlling Video Generation with Motion Trajectories

Daniel Geng, Charles Herrmann, Junhwa Hur, Forrester Cole, Serena Zhang, Tobias Pfaff, Tatiana Lopez-Guevara, Carl Doersch, Yusuf Aytar, Michael Rubinstein, Chen Sun, Oliver Wang, Andrew Owens, Deqing Sun

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments CVPR 2025 camera ready. Project page: https://motion-prompting.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08503 2025-03-28 cs.CV 57%

StyleStudio: Text-Driven Style Transfer with Selective Control of Style Elements

Mingkun Lei, Xue Song, Beier Zhu, Hao Wang, Chi Zhang

专题命中 图像编辑 :text-to-image(abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01107 2025-03-28 cs.CV 57%

VideoHandles: Editing 3D Object Compositions in Videos Using Video Generative Priors

Juil Koo, Paul Guerrero, Chun-Hao Paul Huang, Duygu Ceylan, Minhyuk Sung

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Project page: https://videohandles.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17641 2025-03-25 cs.CV 57%

InstructVEdit: A Holistic Approach for Instructional Video Editing

Chi Zhang, Chengjian Feng, Feng Yan, Qiming Zhang, Mingjin Zhang, Yujie Zhong, Jing Zhang, Lin Ma

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments https://o937-blip.github.io/InstructVEdit

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17197 2025-03-24 cs.CV 57%

FreeUV: Ground-Truth-Free Realistic Facial UV Texture Recovery via Cross-Assembly Inference Strategy

Xingchao Yang, Takafumi Taketomi, Yuki Endo, Yoshihiro Kanamori

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments CVPR 2025. Project: https://yangxingchao.github.io/FreeUV-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09837 2025-03-17 cs.CV cs.AI cs.CL 57%

On the Limitations of Vision-Language Models in Understanding Image Transforms

Ahmad Mustafa Anis, Hasnain Ali, Saquib Sarfraz

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments 8 pages, 15 images

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06020 2025-03-11 cs.CV 57%

VidStyleODE: Disentangled Video Editing via StyleGAN and NeuralODEs

Moayed Haji Ali, Andrew Bond, Tolga Birdal, Duygu Ceylan, Levent Karacan, Erkut Erdem, Aykut Erdem

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Project website: https://cyberiada.github.io/VidStyleODE

Journal ref 2023 IEEE/CVF International Conference on Computer Vision (ICCV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04119 2025-03-07 cs.CV 57%

SCSA: A Plug-and-Play Semantic Continuous-Sparse Attention for Arbitrary Semantic Style Transfer

Chunnan Shang, Zhizhong Wang, Hongwei Wang, Xiangming Meng

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01615 2025-03-07 cs.CV 57%

OmniGuard: Hybrid Manipulation Localization via Augmented Versatile Deep Image Watermarking

Xuanyu Zhang, Zecheng Tang, Zhipei Xu, Runyi Li, Youmin Xu, Bin Chen, Feng Gao, Jian Zhang

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.08910 2025-02-11 cs.CV cs.CR 57%

Progressive Feedback-Enhanced Transformer for Image Forgery Localization

Haochen Zhu, Gang Cao, Xianglin Huang

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03021 2025-02-06 cs.CV eess.IV 57%

PixelShuffler: A Simple Image Translation Through Pixel Rearrangement

Omar Zamzam

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02475 2025-02-05 eess.IV cs.CV physics.med-ph 57%

Style transfer as data augmentation: evaluating unpaired image-to-image translation models in mammography

Emir Ahmed, Spencer A. Thomas, Ciaran Bench

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17570 2025-01-30 eess.IV cs.CV physics.med-ph 57%

Trustworthy image-to-image translation: evaluating uncertainty calibration in unpaired training scenarios

Ciaran Bench, Emir Ahmed, Spencer A. Thomas

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12935 2025-01-23 cs.CV 57%

3D Object Manipulation in a Single Image using Generative Models

Ruisi Zhao, Zechuan Zhang, Zongxin Yang, Yi Yang

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09610 2025-01-15 cs.CV 57%

TextureDiffusion: Target Prompt Disentangled Editing for Various Texture Transfer

Zihan Su, Junhao Zhuang, Chun Yuan

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16531 2025-01-14 cs.CV 57%

GIM: A Million-scale Benchmark for Generative Image Manipulation Detection and Localization

Yirui Chen, Xudong Huang, Quan Zhang, Wei Li, Mingjian Zhu, Qiangyu Yan, Simiao Li, Hanting Chen, Hailin Hu, Jie Yang, Wei Liu, Jie Hu

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Code page: https://github.com/chenyirui/GIM

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04374 2025-01-09 cs.CV 57%

Instructive3D: Editing Large Reconstruction Models with Text Instructions

Kunal Kathare, Ankit Dhiman, K Vikas Gowda, Siddharth Aravindan, Shubham Monga, Basavaraja Shanthappa Vandrotti, Lokesh R Boregowda

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments Accepted at WACV 2025. First two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18301 2025-01-08 cs.CV cs.AI cs.LG 57%

Wavelet-Driven Generalizable Framework for Deepfake Face Forgery Detection

Lalith Bharadwaj Baru, Rohit Boddeda, Shilhora Akshay Patel, Sai Mohan Gajapaka

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments 9 Pages, 2 Figures, 3 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21422 2025-01-07 cs.CV 57%

Revisiting Tampered Scene Text Detection in the Era of Generative AI

Chenfan Qu, Yiwu Zhong, Fengjun Guo, Lianwen Jin

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted by AAAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16330 2025-01-07 cs.CV 57%

LEAST: "Local" text-conditioned image style transfer

Silky Singh, Surgan Jandial, Simra Shahid, Abhinav Java

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted to AI for Content Creation (AI4CC) Workshop at CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19535 2024-12-30 cs.CV 57%

StyleRWKV: High-Quality and High-Efficiency Style Transfer with RWKV-like Architecture

Miaomiao Dai, Qianyu Zhou, Lizhuang Ma

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13565 2024-12-19 cs.CV cs.AI 57%

CA-Edit: Causality-Aware Condition Adapter for High-Fidelity Local Facial Attribute Editing

Xiaole Xian, Xilin He, Zenghao Niu, Junliang Zhang, Weicheng Xie, Siyang Song, Zitong Yu, Linlin Shen

专题命中 图像编辑 :inpainting(abstract);分类 cs.CV

Comments accepted by aaai

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12766 2024-12-18 cs.CV 57%

Towards a Training Free Approach for 3D Scene Editing

Vivek Madhavaram, Shivangana Rawat, Chaitanya Devaguptapu, Charu Sharma, Manohar Kaul

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06643 2024-12-10 cs.CV cs.AI 57%

Detecting Facial Image Manipulations with Multi-Layer CNN Models

Alejandro Marco Montejano, Angela Sanchez Perez, Javier Barrachina, David Ortiz-Perez, Manuel Benavent-Lledo, Jose Garcia-Rodriguez

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04441 2024-12-06 cs.CV 57%

Learning Artistic Signatures: Symmetry Discovery and Style Transfer

Emma Finn, T. Anderson Keller, Emmanouil Theodosis, Demba E. Ba

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02635 2024-12-04 cs.CV 57%

MetaShadow: Object-Centered Shadow Detection, Removal, and Synthesis

Tianyu Wang, Jianming Zhang, Haitian Zheng, Zhihong Ding, Scott Cohen, Zhe Lin, Wei Xiong, Chi-Wing Fu, Luis Figueroa, Soo Ye Kim

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02214 2024-12-04 cs.CV eess.IV 57%

GIST: Towards Photorealistic Style Transfer via Multiscale Geometric Representations

Renan A. Rojas-Gomez, Minh N. Do

专题命中 图像编辑 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01027 2024-12-04 cs.CV 57%

Unleashing In-context Learning of Autoregressive Models for Few-shot Image Manipulation

Bolin Lai, Felix Juefei-Xu, Miao Liu, Xiaoliang Dai, Nikhil Mehta, Chenguang Zhu, Zeyi Huang, James M. Rehg, Sangmin Lee, Ning Zhang, Tong Xiao

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments 18 pages, 16 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏