arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1258 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1258 篇

2510.11050 2025-10-14 cs.CV 70%

Zero-shot Face Editing via ID-Attribute Decoupled Inversion

Yang Hou, Minggu Wang, Jianjun Zhao

机构 * Graduate School and Faculty of Information Science and Electrical Engineering, Kyushu University(九州大学研究生院和信息科学与电气工程学系)

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments Accepted by ICME2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20761 2025-09-29 cs.CV 70%

Unforgettable Lessons from Forgettable Images: Intra-Class Memorability Matters in Computer Vision

Jie Jing, Yongjian Huang, Serena J. -W. Wang, Shuangpeng Han, Lucia Schiatti, Yen-Ling Kuo, Qing Lin, Mengmi Zhang

机构 * Nanyang Technological University(南洋理工大学) Sichuan University(四川大学) Massachusetts Institute of Technology(麻省理工学院) Istituto Italiano di Tecnologia(意大利理工学院) University of Virginia(弗吉尼亚大学)

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13642 2025-09-18 cs.LG cs.CV 70%

LLM-I: LLMs are Naturally Interleaved Multimodal Creators

Zirun Guo, Feng Zhang, Kai Jia, Tao Jin

机构 * Zhejiang University(浙江大学)

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12510 2025-07-22 cs.CV cs.AI cs.LG 70%

Generalized Consistency Trajectory Models for Image Manipulation

Beomsu Kim, Jaemin Kim, Jeongsol Kim, Jong Chul Ye

机构 * KAIST(韩国科学技术院)

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments ICLR 2025 (poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15260 2025-07-15 cs.CV cs.AI 70%

VIVID-10M: A Dataset and Baseline for Versatile and Interactive Video Local Editing

Jiahao Hu, Tianxiong Zhong, Xuebo Wang, Boyuan Jiang, Xingye Tian, Fei Yang, Pengfei Wan, Di Zhang

机构 * Northwest Polytechnical University(西北工业大学) Beijing Institute of Technology(北京理工大学) Kuaishou Technology(快手科技)

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments 10 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19278 2025-06-25 cs.GR 70%

Style Transfer: A Decade Survey

Tianshan Zhang, Hao Tang

专题命中 图像编辑 :image generation(abstract);diffusion(abstract);分类 cs.GR

Comments 32 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09344 2025-06-12 cs.AI cs.CL cs.CV cs.LG cs.SD eess.AS 70%

Ming-Omni: A Unified Multimodal Model for Perception and Generation

Inclusion AI, Biao Gong, Cheng Zou, Chuanyang Zheng, Chunluan Zhou, Canxiang Yan, Chunxiang Jin, Chunjie Shen, Dandan Zheng, Fudong Wang, Furong Xu, GuangMing Yao, Jun Zhou, Jingdong Chen, Jianxin Sun, Jiajia Liu, Jianjiang Zhu, Jun Peng, Kaixiang Ji, Kaiyou Song, Kaimeng Ren, Libin Wang, Lixiang Ru, Lele Xie, Longhua Tan, Lyuxin Xue, Lan Wang, Mochen Bai, Ning Gao, Pei Chen, Qingpei Guo, Qinglong Zhang, Qiang Xu, Rui Liu, Ruijie Xiong, Sirui Gao, Tinghao Liu, Taisong Li, Weilong Chai, Xinyu Xiao, Xiaomei Wang, Xiaoxue Chen, Xiao Lu, Xiaoyu Li, Xingning Dong, Xuzheng Yu, Yi Yuan, Yuting Gao, Yunxiao Sun, Yipeng Chen, Yifei Wu, Yongjie Lyu, Ziping Ma, Zipeng Feng, Zhijiang Fang, Zhihao Qiu, Ziyuan Huang, Zhengyu He

机构 * Inclusion AI

专题命中 图像编辑 :image generation(abstract);image editing(abstract);分类 cs.CV

Comments 18 pages,8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19149 2025-05-27 cs.CV 70%

MIND-Edit: MLLM Insight-Driven Editing via Language-Vision Projection

Shuyu Wang, Weiqi Li, Qian Wang, Shijie Zhao, Jian Zhang

机构 * School of Electronic and Computer Engineering, Peking University(北京大学电子与计算机工程学院) ByteDance Inc.(字节跳动公司)

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10566 2025-05-16 cs.CV 70%

3D-Fixup: Advancing Photo Editing with 3D Priors

Yen-Chi Cheng, Krishna Kumar Singh, Jae Shin Yoon, Alex Schwing, Liangyan Gui, Matheus Gadelha, Paul Guerrero, Nanxuan Zhao

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Adobe Research(Adobe研究)

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments SIGGRAPH 2025. Project page: https://3dfixup.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02064 2025-04-18 cs.CV cs.AI 70%

ArtCrafter: Text-Image Aligning Style Transfer via Embedding Reframing

Nisha Huang, Kaer Huang, Yifan Pu, Jiangshan Wang, Jie Guo, Yiqiang Yan, Xiu Li, Tong-Yee Lee

专题命中 图像编辑 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments 13 pages, 17 figures, submitted to a journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23618 2025-04-01 cs.CV 70%

Leveraging Vision-Language Foundation Models to Reveal Hidden Image-Attribute Relationships in Medical Imaging

Amar Kumar, Anita Kriz, Barak Pertzov, Tal Arbel

专题命中 图像编辑 :image generation(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13436 2025-03-18 cs.CV cs.LG 70%

Unified Autoregressive Visual Generation and Understanding with Continuous Tokens

Lijie Fan, Luming Tang, Siyang Qin, Tianhong Li, Xuan Yang, Siyuan Qiao, Andreas Steiner, Chen Sun, Yuanzhen Li, Tao Zhu, Michael Rubinstein, Michalis Raptis, Deqing Sun, Radu Soricut

专题命中 图像编辑 :image generation(abstract);image editing(abstract);分类 cs.CV

Comments Tech report

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16832 2025-03-18 cs.CV cs.AI cs.LG 70%

Edit Away and My Face Will not Stay: Personal Biometric Defense against Malicious Generative Editing

Hanhui Wang, Yihua Zhang, Ruizheng Bai, Yue Zhao, Sijia Liu, Zhengzhong Tu

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments GitHub: https://github.com/taco-group/FaceLock

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04116 2025-02-11 cs.LG cs.CV 70%

Generative Adversarial Networks Bridging Art and Machine Intelligence

Junhao Song, Yichao Zhang, Ziqian Bi, Tianyang Wang, Keyu Chen, Ming Li, Qian Niu, Junyu Liu, Benji Peng, Sen Zhang, Ming Liu, Jiawei Xu, Xuanhe Pan, Jinlang Wang, Pohsun Feng, Yizhu Wen, Lawrence K. Q. Yan, Hong-Ming Tseng, Xinyuan Song, Jintao Ren, Silin Chen, Yunze Wang, Weiche Hsieh, Bowen Jing, Junjie Yang, Jun Zhou, Zheyu Yao, Chia Xin Liang

专题命中 图像编辑 :image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18096 2025-01-31 cs.CV cs.AI cs.CL cs.LG 70%

LLMs can see and hear without any training

Kumar Ashutosh, Yossi Gandelsman, Xinlei Chen, Ishan Misra, Rohit Girdhar

专题命中 图像编辑 :image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Code: https://github.com/facebookresearch/MILS

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14945 2025-01-28 cs.CV 70%

MATCHA:Towards Matching Anything

Fei Xue, Sven Elflein, Laura Leal-Taixé, Qunjie Zhou

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04325 2025-01-09 cs.CV 70%

Edit as You See: Image-guided Video Editing via Masked Motion Modeling

Zhi-Lin Huang, Yixuan Liu, Chujun Qin, Zhongdao Wang, Dong Zhou, Dong Li, Emad Barsoum

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03098 2024-12-05 cs.CV cs.AI cs.LG 70%

Local Lesion Generation is Effective for Capsule Endoscopy Image Data Augmentation in a Limited Data Setting

Adrian B. Chłopowiec, Adam R. Chłopowiec, Krzysztof Galus, Wojciech Cebula, Martin Tabakov

专题命中 图像编辑 :image editing(abstract);inpainting(abstract);分类 cs.CV

Comments 54 pages, 35 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17864 2024-11-28 cs.CV 70%

Generative Image Layer Decomposition with Visual Effects

Jinrui Yang, Qing Liu, Yijun Li, Soo Ye Kim, Daniil Pakhomov, Mengwei Ren, Jianming Zhang, Zhe Lin, Cihang Xie, Yuyin Zhou

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments The project page: https://rayjryang.github.io/LayerDecomp

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13019 2024-11-21 cs.CV 70%

Open-World Amodal Appearance Completion

Jiayang Ao, Yanbei Jiang, Qiuhong Ke, Krista A. Ehinger

专题命中 图像编辑 :image editing(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.16861 2024-11-20 cs.CV 70%

Repositioning the Subject within Image

Yikai Wang, Chenjie Cao, Ke Fan, Qiaole Dong, Yifan Li, Xiangyang Xue, Yanwei Fu

专题命中 图像编辑 :diffusion(abstract);inpainting(abstract);分类 cs.CV

Comments Accepted by TMLR. Arxiv version uses small size images. Full size PDF, code, and dataset are available at https://yikai-wang.github.io/seele/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08666 2024-11-19 cs.CV cs.AI 70%

A Survey on Vision Autoregressive Model

Kai Jiang, Jiaxing Huang

专题命中 图像编辑 :image generation(abstract);image editing(abstract);分类 cs.CV

Comments This work will be integrated into another project

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15035 2024-09-24 cs.CV cs.CL 70%

Can CLIP Count Stars? An Empirical Study on Quantity Bias in CLIP

Zeliang Zhang, Zhuo Liu, Mingqian Feng, Chenliang Xu

专题命中 图像编辑 :image generation(abstract);image editing(abstract);分类 cs.CV

Comments Short paper. Accepted by the Findings of EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00106 2024-08-02 cs.CV cs.AI 70%

WAS: Dataset and Methods for Artistic Text Segmentation

Xudong Xie, Yuzhe Li, Yang Liu, Zhifei Zhang, Zhaowen Wang, Wei Xiong, Xiang Bai

专题命中 图像编辑 :image generation(abstract);diffusion(abstract);分类 cs.CV

Comments Accepted by ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17850 2024-07-26 cs.CV 70%

FlexiEdit: Frequency-Aware Latent Refinement for Enhanced Non-Rigid Editing

Gwanhyeong Koo, Sunjae Yoon, Ji Woo Hong, Chang D. Yoo

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05059 2024-06-18 cs.CV 70%

GenHeld: Generating and Editing Handheld Objects

Chaerin Min, Srinath Sridhar

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12490 2024-05-22 cs.CV 70%

Customize Your Own Paired Data via Few-shot Way

Jinshu Chen, Bingchuan Li, Miao Hua, Panpan Xu, Qian He

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments Accepted by AI4CC CVPR2024 WorkShop

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18818 2024-03-28 cs.CV 70%

ObjectDrop: Bootstrapping Counterfactuals for Photorealistic Object Removal and Insertion

Daniel Winter, Matan Cohen, Shlomi Fruchter, Yael Pritch, Alex Rav-Acha, Yedid Hoshen

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.09618 2024-03-28 cs.CV cs.AI cs.CL cs.HC cs.LG 70%

HIVE: Harnessing Human Feedback for Instructional Visual Editing

Shu Zhang, Xinyi Yang, Yihao Feng, Can Qin, Chia-Chih Chen, Ning Yu, Zeyuan Chen, Huan Wang, Silvio Savarese, Stefano Ermon, Caiming Xiong, Ran Xu

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments In CVPR, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16974 2024-03-20 cs.CV 70%

COLE: A Hierarchical Generation Framework for Multi-Layered and Editable Graphic Design

Peidong Jia, Chenxuan Li, Yuhui Yuan, Zeyu Liu, Yichao Shen, Bohan Chen, Xingru Chen, Yinglin Zheng, Dong Chen, Ji Li, Xiaodong Xie, Shanghang Zhang, Baining Guo

专题命中 图像编辑 :diffusion(abstract);image editing(abstract);分类 cs.CV

Comments Technical report. Project page: https://graphic-design-generation-github-io.vercel.app/

详情

展开后加载摘要…

URL PDF HTML 收藏