arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 69953 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69953 篇

2403.01329 2024-03-05 cs.LG cs.AI cs.CV 85%

Bespoke Non-Stationary Solvers for Fast Sampling of Diffusion and Flow Models

Neta Shaul, Uriel Singer, Ricky T. Q. Chen, Matthew Le, Ali Thabet, Albert Pumarola, Yaron Lipman

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12945 2024-02-06 cs.CV 85%

Lumiere: A Space-Time Diffusion Model for Video Generation

Omer Bar-Tal, Hila Chefer, Omer Tov, Charles Herrmann, Roni Paiss, Shiran Zada, Ariel Ephrat, Junhwa Hur, Guanghui Liu, Amit Raj, Yuanzhen Li, Michael Rubinstein, Tomer Michaeli, Oliver Wang, Deqing Sun, Tali Dekel, Inbar Mosseri

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);inpainting(abstract);分类 cs.CV

Comments Webpage: https://lumiere-video.github.io/ | Video: https://www.youtube.com/watch?v=wxLr02Dz2Sc

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.14379 2024-01-26 cs.CV cs.LG 85%

UrbanGenAI: Reconstructing Urban Landscapes using Panoptic Segmentation and Diffusion Models

Timo Kapsalis

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 19 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12244 2024-01-24 cs.CV cs.AI cs.LG 85%

Large-scale Reinforcement Learning for Diffusion Models

Yinan Zhang, Eric Tzeng, Yilun Du, Dmitry Kislyuk

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10247 2024-01-22 cs.CV cs.LG 85%

Resolution Chromatography of Diffusion Models

Juno Hwang, Yong-Hyun Park, Junghyo Jo

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments 24 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08725 2024-01-18 cs.CV 85%

Revealing Vulnerabilities in Stable Diffusion via Targeted Attacks

Chenyu Zhang, Lanjun Wang, Anan Liu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03209 2024-01-15 cs.CV 85%

Cache Me if You Can: Accelerating Diffusion Models through Block Caching

Felix Wimbauer, Bichen Wu, Edgar Schoenfeld, Xiaoliang Dai, Ji Hou, Zijian He, Artsiom Sanakoyeu, Peizhao Zhang, Sam Tsai, Jonas Kohler, Christian Rupprecht, Daniel Cremers, Peter Vajda, Jialiang Wang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments Project page: https://fwmb.github.io/blockcaching/

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.17599 2024-01-05 cs.CV 85%

Zero-Shot Video Editing Using Off-The-Shelf Image Diffusion Models

Wen Wang, Yan Jiang, Kangyang Xie, Zide Liu, Hao Chen, Yue Cao, Xinlong Wang, Chunhua Shen

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Add customized video editing. Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11285 2023-12-29 cs.CV cs.AI 85%

Adv-Diffusion: Imperceptible Adversarial Face Identity Attack via Latent Diffusion Model

Decheng Liu, Xijun Wang, Chunlei Peng, Nannan Wang, Ruiming Hu, Xinbo Gao

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV

Comments Accepted by AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.08818 2023-12-29 cs.CV cs.LG 85%

Align your Latents: High-Resolution Video Synthesis with Latent Diffusion Models

Andreas Blattmann, Robin Rombach, Huan Ling, Tim Dockhorn, Seung Wook Kim, Sanja Fidler, Karsten Kreis

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments Conference on Computer Vision and Pattern Recognition (CVPR) 2023. Project page: https://research.nvidia.com/labs/toronto-ai/VideoLDM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09759 2023-12-25 cs.CV 85%

Scene Text Image Super-resolution based on Text-conditional Diffusion Models

Chihiro Noguchi, Shun Fukuda, Masao Yamanaka

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

Comments WACV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12232 2023-12-20 cs.CV 85%

Brush Your Text: Synthesize Any Scene Text on Images via Diffusion Model

Lingjun Zhang, Xinyuan Chen, Yaohui Wang, Yue Lu, Yu Qiao

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted to AAAI 2024. Code: https://github.com/ecnuljzhang/brush-your-text

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02669 2023-12-19 cs.CV 85%

ConceptLab: Creative Concept Generation using VLM-Guided Diffusion Prior Constraints

Elad Richardson, Kfir Goldberg, Yuval Alaluf, Daniel Cohen-Or

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Project page: https://kfirgoldberg.github.io/ConceptLab/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06285 2023-12-12 cs.CV cs.AI 85%

Compensation Sampling for Improved Convergence in Diffusion Models

Hui Lu, Albert ali Salah, Ronald Poppe

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.05431 2023-12-12 cs.CV cs.AI 85%

Efficient Quantization Strategies for Latent Diffusion Models

Yuewei Yang, Xiaoliang Dai, Jialiang Wang, Peizhao Zhang, Hongbo Zhang

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04429 2023-12-08 cs.CV 85%

Approximate Caching for Efficiently Serving Diffusion Models

Shubham Agarwal, Subrata Mitra, Sarthak Chakraborty, Srikrishna Karanam, Koyel Mukherjee, Shiv Saini

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted at NSDI'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.16948 2023-12-06 cs.CV cs.AI 85%

Denoising Diffusion Bridge Models

Linqi Zhou, Aaron Lou, Samar Khanna, Stefano Ermon

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

Comments Github: https://github.com/alexzhou907/DDBM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00748 2023-12-04 cs.CV cs.LG 85%

PathLDM: Text conditioned Latent Diffusion Model for Histopathology

Srikar Yellapragada, Alexandros Graikos, Prateek Prasanna, Tahsin Kurc, Joel Saltz, Dimitris Samaras

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments WACV 2024 publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15127 2023-11-28 cs.CV 85%

Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets

Andreas Blattmann, Tim Dockhorn, Sumith Kulal, Daniel Mendelevitch, Maciej Kilian, Dominik Lorenz, Yam Levi, Zion English, Vikram Voleti, Adam Letts, Varun Jampani, Robin Rombach

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.10373 2023-11-21 cs.CV 85%

TokenFlow: Consistent Diffusion Features for Consistent Video Editing

Michal Geyer, Omer Bar-Tal, Shai Bagon, Tali Dekel

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09221 2023-11-16 cs.CV 85%

Single-Image 3D Human Digitization with Shape-Guided Diffusion

Badour AlBahar, Shunsuke Saito, Hung-Yu Tseng, Changil Kim, Johannes Kopf, Jia-Bin Huang

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);image synthesis(abstract);分类 cs.CV

Comments SIGGRAPH Asia 2023. Project website: https://human-sgd.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.05556 2023-11-10 cs.CV cs.LG 85%

LCM-LoRA: A Universal Stable-Diffusion Acceleration Module

Simian Luo, Yiqin Tan, Suraj Patil, Daniel Gu, Patrick von Platen, Apolinário Passos, Longbo Huang, Jian Li, Hang Zhao

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18729 2023-11-08 cs.CV 85%

Real-World Image Variation by Aligning Diffusion Inversion Chain

Yuechen Zhang, Jinbo Xing, Eric Lo, Jiaya Jia

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

Comments NuerIPS 2023 Spotlight. 21 pages; Code: https://github.com/dvlab-research/RIVAL/ Project page: https://rival-diff.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.00056 2023-11-02 cs.CV cs.AI cs.LG 85%

Diversity and Diffusion: Observations on Synthetic Image Distributions with Stable Diffusion

David Marwood, Shumeet Baluja, Yair Alon

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00219 2023-10-31 cs.CV cs.AI cs.CL cs.LG 85%

Diffusion Brush: A Latent Diffusion Model-based Editing Tool for AI-generated Images

Peyman Gholami, Robert Xiao

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10765 2023-10-24 cs.CV cs.AI cs.CL 85%

BiomedJourney: Counterfactual Biomedical Image Generation by Instruction-Learning from Multimodal Patient Journeys

Yu Gu, Jianwei Yang, Naoto Usuyama, Chunyuan Li, Sheng Zhang, Matthew P. Lungren, Jianfeng Gao, Hoifung Poon

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);image editing(abstract);分类 cs.CV

Comments Project page & demo: https://aka.ms/biomedjourney

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01506 2023-10-20 cs.CV 85%

Direct Inversion: Boosting Diffusion-based Editing with 3 Lines of Code

Xuan Ju, Ailing Zeng, Yuxuan Bian, Shaoteng Liu, Qiang Xu

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07702 2023-10-12 cs.CV 85%

ScaleCrafter: Tuning-free Higher-Resolution Visual Generation with Diffusion Models

Yingqing He, Shaoshu Yang, Haoxin Chen, Xiaodong Cun, Menghan Xia, Yong Zhang, Xintao Wang, Ran He, Qifeng Chen, Ying Shan

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);image synthesis(abstract);分类 cs.CV

Comments Project page: https://yingqinghe.github.io/scalecrafter/ Github: https://github.com/YingqingHe/ScaleCrafter

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06160 2023-10-11 cs.CV 85%

DatasetDM: Synthesizing Data with Perception Annotations Using Diffusion Models

Weijia Wu, Yuzhong Zhao, Hao Chen, Yuchao Gu, Rui Zhao, Yefei He, Hong Zhou, Mike Zheng Shou, Chunhua Shen

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);image synthesis(abstract);分类 cs.CV

Journal ref Proc. Advances In Neural Information Processing Systems (NeurIPS 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01110 2023-10-03 cs.LG cs.AI cs.CV stat.ML 85%

Prompt-tuning latent diffusion models for inverse problems

Hyungjin Chung, Jong Chul Ye, Peyman Milanfar, Mauricio Delbracio

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);inpainting(abstract);分类 cs.CV

Comments 22 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏