arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 69953 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69953 篇

2403.00437 2024-08-07 cs.CV cs.AI cs.GR cs.LG 84%

LoMOE: Localized Multi-Object Editing via Multi-Diffusion

Goirik Chakrabarty, Aditya Chandrasekar, Ramya Hebbalaguppe, Prathosh AP

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV、cs.GR

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03720 2024-06-07 cs.CV cs.MM 84%

JIGMARK: A Black-Box Approach for Enhancing Image Watermarks against Diffusion Model Edits

Minzhou Pan, Yi Zeng, Xue Lin, Ning Yu, Cho-Jui Hsieh, Peter Henderson, Ruoxi Jia

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00672 2024-05-02 cs.GR cs.CV 84%

TexSliders: Diffusion-Based Texture Editing in CLIP Space

Julia Guerrero-Viu, Milos Hasan, Arthur Roullier, Midhun Harikumar, Yiwei Hu, Paul Guerrero, Diego Gutierrez, Belen Masia, Valentin Deschaintre

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV、cs.GR

Comments SIGGRAPH 2024 Conference Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.00666 2024-05-02 cs.CV cs.GR 84%

RGB$\leftrightarrow$X: Image decomposition and synthesis using material- and lighting-aware diffusion models

Zheng Zeng, Valentin Deschaintre, Iliyan Georgiev, Yannick Hold-Geoffroy, Yiwei Hu, Fujun Luan, Ling-Qi Yan, Miloš Hašan

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV、cs.GR

Journal ref SIGGRAPH Conference Papers '24, July 27-August 1, 2024, Denver, CO, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02238 2024-04-24 cs.CV cs.AI cs.MM 84%

X-Adapter: Adding Universal Compatibility of Plugins for Upgraded Diffusion Model

Lingmin Ran, Xiaodong Cun, Jia-Wei Liu, Rui Zhao, Song Zijie, Xintao Wang, Jussi Keppo, Mike Zheng Shou

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV、cs.MM

Comments Project page: https://showlab.github.io/X-Adapter/

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05608 2024-03-29 cs.CV cs.MM 84%

Scalable Diffusion Models with State Space Backbone

Zhengcong Fei, Mingyuan Fan, Changqian Yu, Junshi Huang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17870 2024-03-27 cs.CV cs.MM 84%

Boosting Diffusion Models with Moving Average Sampling in Frequency Domain

Yurui Qian, Qi Cai, Yingwei Pan, Yehao Li, Ting Yao, Qibin Sun, Tao Mei

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.MM

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17782 2024-03-27 cs.CV cs.GR 84%

GenesisTex: Adapting Image Denoising Diffusion to Texture Space

Chenjian Gao, Boyan Jiang, Xinghui Li, Yingpeng Zhang, Qian Yu

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV、cs.GR

Comments 12 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.19330 2024-03-27 cs.CV cs.MM 84%

A Novel Approach to Industrial Defect Generation through Blended Latent Diffusion Model with Online Adaptation

Hanxi Li, Zhengxun Zhang, Hao Chen, Lin Wu, Bo Li, Deyin Liu, Mingwen Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.MM

Comments 13 pages,7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10474 2024-03-27 cs.CV cs.GR cs.LG 84%

Preserve Your Own Correlation: A Noise Prior for Video Diffusion Models

Songwei Ge, Seungjun Nah, Guilin Liu, Tyler Poon, Andrew Tao, Bryan Catanzaro, David Jacobs, Jia-Bin Huang, Ming-Yu Liu, Yogesh Balaji

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.GR

Comments ICCV 2023. Project webpage: https://research.nvidia.com/labs/dir/pyoco

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17004 2024-03-26 cs.CV cs.MM 84%

SD-DiT: Unleashing the Power of Self-supervised Discrimination in Diffusion Transformer

Rui Zhu, Yingwei Pan, Yehao Li, Ting Yao, Zhenglong Sun, Tao Mei, Chang Wen Chen

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.MM

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12032 2024-03-20 cs.CV cs.GR 84%

Generic 3D Diffusion Adapter Using Controlled Multi-View Editing

Hansheng Chen, Ruoxi Shi, Yulin Liu, Bokui Shen, Jiayuan Gu, Gordon Wetzstein, Hao Su, Leonidas Guibas

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV、cs.GR

Comments V2 note: Fix missing acknowledgements. Project page: https://lakonik.github.io/mvedit

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17664 2024-02-01 cs.CV cs.GR 84%

Image Anything: Towards Reasoning-coherent and Training-free Multi-modal Image Generation

Yuanhuiyi Lyu, Xu Zheng, Lin Wang

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04559 2023-12-08 cs.CV cs.GR 84%

PrimDiffusion: Volumetric Primitives Diffusion for 3D Human Generation

Zhaoxi Chen, Fangzhou Hong, Haiyi Mei, Guangcong Wang, Lei Yang, Ziwei Liu

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV、cs.GR

Comments NeurIPS 2023; Project page https://frozenburning.github.io/projects/primdiffusion/ Code available at https://github.com/FrozenBurning/PrimDiffusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02190 2023-12-08 cs.CV cs.GR 84%

Diffusion Handles: Enabling 3D Edits for Diffusion Models by Lifting Activations to 3D

Karran Pandey, Paul Guerrero, Matheus Gadelha, Yannick Hold-Geoffroy, Karan Singh, Niloy Mitra

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV、cs.GR

Comments Project Webpage: https://diffusionhandles.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00971 2023-12-05 cs.CV cs.GR 84%

Consistent Mesh Diffusion

Julian Knodt, Xifeng Gao

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00944 2023-12-05 cs.CV cs.GR 84%

Enhancing Diffusion Models with 3D Perspective Geometry Constraints

Rishi Upadhyay, Howard Zhang, Yunhao Ba, Ethan Yang, Blake Gella, Sicheng Jiang, Alex Wong, Achuta Kadambi

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV、cs.GR

Comments Project Webpage: http://visual.ee.ucla.edu/diffusionperspective.htm/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00116 2023-12-04 cs.CV cs.GR cs.LG 84%

S2ST: Image-to-Image Translation in the Seed Space of Latent Diffusion

Or Greenberg, Eran Kishon, Dani Lischinski

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.GR

Comments 17 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07885 2023-11-15 cs.CV cs.AI cs.GR 84%

One-2-3-45++: Fast Single Image to 3D Objects with Consistent Multi-View Generation and 3D Diffusion

Minghua Liu, Ruoxi Shi, Linghao Chen, Zhuoyang Zhang, Chao Xu, Xinyue Wei, Hansheng Chen, Chong Zeng, Jiayuan Gu, Hao Su

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.05464 2023-11-10 cs.CV cs.MM 84%

3DStyle-Diffusion: Pursuing Fine-grained Text-driven 3D Stylization with 2D Diffusion Models

Haibo Yang, Yang Chen, Yingwei Pan, Ting Yao, Zhineng Chen, Tao Mei

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV、cs.MM

Comments ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.02048 2023-09-15 cs.CV cs.GR cs.LG 84%

Efficient Spatially Sparse Inference for Conditional GANs and Diffusion Models

Muyang Li, Ji Lin, Chenlin Meng, Stefano Ermon, Song Han, Jun-Yan Zhu

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV、cs.GR

Comments NeurIPS 2022 T-PAMI 2023 Website: https://www.cs.cmu.edu/~sige/ Code: https://github.com/lmxyy/sige

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.00262 2023-09-01 cs.CV cs.GR cs.LG 84%

Collage Diffusion

Vishnu Sarukkai, Linden Li, Arden Ma, Christopher Ré, Kayvon Fatahalian

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02874 2023-08-08 cs.CV cs.MM 84%

Sketch and Text Guided Diffusion Model for Colored Point Cloud Generation

Zijie Wu, Yaonan Wang, Mingtao Feng, He Xie, Ajmal Mian

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.MM

Comments Accepted by ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.15042 2023-08-01 cs.CV cs.GR 84%

TEDi: Temporally-Entangled Diffusion for Long-Term Motion Synthesis

Zihan Zhang, Richard Liu, Kfir Aberman, Rana Hanocka

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV、cs.GR

Comments Project page: https://threedle.github.io/TEDi/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03414 2023-06-19 cs.CV cs.AI cs.GR 84%

DreamSparse: Escaping from Plato's Cave with 2D Frozen Diffusion Model Given Sparse Views

Paul Yoo, Jiaxian Guo, Yutaka Matsuo, Shixiang Shane Gu

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.10167 2023-05-26 cs.CV cs.GR cs.LG 84%

Cross-domain Compositing with Pretrained Diffusion Models

Roy Hachnochi, Mingrui Zhao, Nadav Orzech, Rinon Gal, Ali Mahdavi-Amiri, Daniel Cohen-Or, Amit Haim Bermano

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV、cs.GR

Comments Code: https://github.com/cross-domain-compositing/cross-domain-compositing

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.04968 2023-04-27 cs.CV cs.GR cs.LG 84%

Re-imagine the Negative Prompt Algorithm: Transform 2D Diffusion into 3D, alleviate Janus problem and Beyond

Mohammadreza Armandpour, Ali Sadeghian, Huangjie Zheng, Amir Sadeghian, Mingyuan Zhou

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV、cs.GR

Comments Our project page is available at https://Perp-Neg.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.11105 2023-04-24 cs.CV cs.GR 84%

Improved Diffusion-based Image Colorization via Piggybacked Models

Hanyuan Liu, Jinbo Xing, Minshan Xie, Chengze Li, Tien-Tsin Wong

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV、cs.GR

Comments project page: https://piggyback-color.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.05371 2023-03-29 cs.CV cs.GR 84%

3DGen: Triplane Latent Diffusion for Textured Mesh Generation

Anchit Gupta, Wenhan Xiong, Yixin Nie, Ian Jones, Barlas Oğuz

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.00792 2023-02-17 cs.CV cs.GR 84%

SparseFusion: Distilling View-conditioned Diffusion for 3D Reconstruction

Zhizhuo Zhou, Shubham Tulsiani

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV、cs.GR

Comments project page: https://sparsefusion.github.io/ v2: typo corrected in table 3 v3: added ablation

详情

展开后加载摘要…

URL PDF HTML 收藏