arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1260 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1260 篇

2503.01107 2025-03-28 cs.CV 57%

VideoHandles: Editing 3D Object Compositions in Videos Using Video Generative Priors

Juil Koo, Paul Guerrero, Chun-Hao Paul Huang, Duygu Ceylan, Minhyuk Sung

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Project page: https://videohandles.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17641 2025-03-25 cs.CV 57%

InstructVEdit: A Holistic Approach for Instructional Video Editing

Chi Zhang, Chengjian Feng, Feng Yan, Qiming Zhang, Mingjin Zhang, Yujie Zhong, Jing Zhang, Lin Ma

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments https://o937-blip.github.io/InstructVEdit

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17197 2025-03-24 cs.CV 57%

FreeUV: Ground-Truth-Free Realistic Facial UV Texture Recovery via Cross-Assembly Inference Strategy

Xingchao Yang, Takafumi Taketomi, Yuki Endo, Yoshihiro Kanamori

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments CVPR 2025. Project: https://yangxingchao.github.io/FreeUV-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09837 2025-03-17 cs.CV cs.AI cs.CL 57%

On the Limitations of Vision-Language Models in Understanding Image Transforms

Ahmad Mustafa Anis, Hasnain Ali, Saquib Sarfraz

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments 8 pages, 15 images

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06020 2025-03-11 cs.CV 57%

VidStyleODE: Disentangled Video Editing via StyleGAN and NeuralODEs

Moayed Haji Ali, Andrew Bond, Tolga Birdal, Duygu Ceylan, Levent Karacan, Erkut Erdem, Aykut Erdem

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Project website: https://cyberiada.github.io/VidStyleODE

Journal ref 2023 IEEE/CVF International Conference on Computer Vision (ICCV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04119 2025-03-07 cs.CV 57%

SCSA: A Plug-and-Play Semantic Continuous-Sparse Attention for Arbitrary Semantic Style Transfer

Chunnan Shang, Zhizhong Wang, Hongwei Wang, Xiangming Meng

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01615 2025-03-07 cs.CV 57%

OmniGuard: Hybrid Manipulation Localization via Augmented Versatile Deep Image Watermarking

Xuanyu Zhang, Zecheng Tang, Zhipei Xu, Runyi Li, Youmin Xu, Bin Chen, Feng Gao, Jian Zhang

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.08910 2025-02-11 cs.CV cs.CR 57%

Progressive Feedback-Enhanced Transformer for Image Forgery Localization

Haochen Zhu, Gang Cao, Xianglin Huang

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03021 2025-02-06 cs.CV eess.IV 57%

PixelShuffler: A Simple Image Translation Through Pixel Rearrangement

Omar Zamzam

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02475 2025-02-05 eess.IV cs.CV physics.med-ph 57%

Style transfer as data augmentation: evaluating unpaired image-to-image translation models in mammography

Emir Ahmed, Spencer A. Thomas, Ciaran Bench

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17570 2025-01-30 eess.IV cs.CV physics.med-ph 57%

Trustworthy image-to-image translation: evaluating uncertainty calibration in unpaired training scenarios

Ciaran Bench, Emir Ahmed, Spencer A. Thomas

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12935 2025-01-23 cs.CV 57%

3D Object Manipulation in a Single Image using Generative Models

Ruisi Zhao, Zechuan Zhang, Zongxin Yang, Yi Yang

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09610 2025-01-15 cs.CV 57%

TextureDiffusion: Target Prompt Disentangled Editing for Various Texture Transfer

Zihan Su, Junhao Zhuang, Chun Yuan

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16531 2025-01-14 cs.CV 57%

GIM: A Million-scale Benchmark for Generative Image Manipulation Detection and Localization

Yirui Chen, Xudong Huang, Quan Zhang, Wei Li, Mingjian Zhu, Qiangyu Yan, Simiao Li, Hanting Chen, Hailin Hu, Jie Yang, Wei Liu, Jie Hu

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Code page: https://github.com/chenyirui/GIM

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04374 2025-01-09 cs.CV 57%

Instructive3D: Editing Large Reconstruction Models with Text Instructions

Kunal Kathare, Ankit Dhiman, K Vikas Gowda, Siddharth Aravindan, Shubham Monga, Basavaraja Shanthappa Vandrotti, Lokesh R Boregowda

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments Accepted at WACV 2025. First two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18301 2025-01-08 cs.CV cs.AI cs.LG 57%

Wavelet-Driven Generalizable Framework for Deepfake Face Forgery Detection

Lalith Bharadwaj Baru, Rohit Boddeda, Shilhora Akshay Patel, Sai Mohan Gajapaka

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments 9 Pages, 2 Figures, 3 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21422 2025-01-07 cs.CV 57%

Revisiting Tampered Scene Text Detection in the Era of Generative AI

Chenfan Qu, Yiwu Zhong, Fengjun Guo, Lianwen Jin

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted by AAAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16330 2025-01-07 cs.CV 57%

LEAST: "Local" text-conditioned image style transfer

Silky Singh, Surgan Jandial, Simra Shahid, Abhinav Java

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted to AI for Content Creation (AI4CC) Workshop at CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19535 2024-12-30 cs.CV 57%

StyleRWKV: High-Quality and High-Efficiency Style Transfer with RWKV-like Architecture

Miaomiao Dai, Qianyu Zhou, Lizhuang Ma

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13565 2024-12-19 cs.CV cs.AI 57%

CA-Edit: Causality-Aware Condition Adapter for High-Fidelity Local Facial Attribute Editing

Xiaole Xian, Xilin He, Zenghao Niu, Junliang Zhang, Weicheng Xie, Siyang Song, Zitong Yu, Linlin Shen

专题命中 图像编辑 :inpainting(abstract);分类 cs.CV

Comments accepted by aaai

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12766 2024-12-18 cs.CV 57%

Towards a Training Free Approach for 3D Scene Editing

Vivek Madhavaram, Shivangana Rawat, Chaitanya Devaguptapu, Charu Sharma, Manohar Kaul

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06643 2024-12-10 cs.CV cs.AI 57%

Detecting Facial Image Manipulations with Multi-Layer CNN Models

Alejandro Marco Montejano, Angela Sanchez Perez, Javier Barrachina, David Ortiz-Perez, Manuel Benavent-Lledo, Jose Garcia-Rodriguez

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04441 2024-12-06 cs.CV 57%

Learning Artistic Signatures: Symmetry Discovery and Style Transfer

Emma Finn, T. Anderson Keller, Emmanouil Theodosis, Demba E. Ba

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02635 2024-12-04 cs.CV 57%

MetaShadow: Object-Centered Shadow Detection, Removal, and Synthesis

Tianyu Wang, Jianming Zhang, Haitian Zheng, Zhihong Ding, Scott Cohen, Zhe Lin, Wei Xiong, Chi-Wing Fu, Luis Figueroa, Soo Ye Kim

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02214 2024-12-04 cs.CV eess.IV 57%

GIST: Towards Photorealistic Style Transfer via Multiscale Geometric Representations

Renan A. Rojas-Gomez, Minh N. Do

专题命中 图像编辑 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01027 2024-12-04 cs.CV 57%

Unleashing In-context Learning of Autoregressive Models for Few-shot Image Manipulation

Bolin Lai, Felix Juefei-Xu, Miao Liu, Xiaoliang Dai, Nikhil Mehta, Chenguang Zhu, Zeyi Huang, James M. Rehg, Sangmin Lee, Ning Zhang, Tong Xiao

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments 18 pages, 16 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19231 2024-12-02 cs.CV 57%

Z-STAR+: A Zero-shot Style Transfer Method via Adjusting Style Distribution

Yingying Deng, Xiangyu He, Fan Tang, Weiming Dong

专题命中 图像编辑 :diffusion(abstract);分类 cs.CV

Comments technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17235 2024-11-27 cs.CV 57%

MLI-NeRF: Multi-Light Intrinsic-Aware Neural Radiance Fields

Yixiong Yang, Shilin Hu, Haoyu Wu, Ramon Baldrich, Dimitris Samaras, Maria Vanrell

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted paper for the International Conference on 3D Vision 2025. Project page: https://github.com/liulisixin/MLI-NeRF

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00234 2024-11-20 cs.CR cs.CV eess.IV 57%

Pixel-Inconsistency Modeling for Image Manipulation Localization

Chenqi Kong, Anwei Luo, Shiqi Wang, Haoliang Li, Anderson Rocha, Alex C. Kot

专题命中 图像编辑 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.09102 2024-11-19 cs.CV cs.LG 57%

Face Generation and Editing with StyleGAN: A Survey

Andrew Melnik, Maksim Miasayedzenkau, Dzianis Makarovets, Dzianis Pirshtuk, Eren Akbulut, Dennis Holzmann, Tarek Renusch, Gustav Reichert, Helge Ritter

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Journal ref in IEEE Transactions on Pattern Analysis and Machine Intelligence, vol. 46, no. 5, pp. 3557-3576, May 2024

详情

展开后加载摘要…

URL PDF HTML 收藏