arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 69989 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 69989 篇

2412.02099 2025-06-17 cs.CV cs.AI 83%

AccDiffusion v2: Towards More Accurate Higher-Resolution Diffusion Extrapolation

Zhihang Lin, Mingbao Lin, Wengyi Zhan, Rongrong Ji

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University, China(中国教育部多媒体可信感知与高效计算重点实验室,厦门大学,中国) Shanghai Innovation Institute, Shanghai, China(上海创新研究院,上海,中国) Rakuten Asia Pte. Ltd., Singapore 048946(Rakuten Asia(新加坡)) Institute of Artificial Intelligence, Xiamen University, Xiamen 361005, China(厦门大学人工智能研究院,厦门,中国)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments 13 pages. arXiv admin note: text overlap with arXiv:2407.10738

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07903 2025-06-16 cs.LG cs.AI cs.CV 83%

Diffuse Everything: Multimodal Diffusion Models on Arbitrary State Spaces

Kevin Rojas, Yuchen Zhu, Sichen Zhu, Felix X. -F. Ye, Molei Tao

机构 * Machine Learning Center, Georgia Institute of Technology, Atlanta, GA School of Mathematics, Georgia Institute of Technology, Atlanta, GA Department of Mathematics \& Statistics, SUNY Albany, NY

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Accepted to ICML 2025. Code available at https://github.com/KevinRojas1499/Diffuse-Everything

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10233 2025-06-13 eess.IV cs.CV 83%

Conditional diffusion models for guided anomaly detection in brain images using fluid-driven anomaly randomization

Ana Lawry Aguila, Peirong Liu, Oula Puonti, Juan Eugenio Iglesias

机构 * Athinoula A. Martinos Center for Biomedical Imaging, Massachusetts General Hospital and Harvard Medical School, Boston, USA(Athinoula A. Martinos 生物医学成像中心、麻省总医院和哈佛医学院,波士顿,美国) Danish Research Centre for Magnetic Resonance, Department of Radiology and Nuclear Medicine(丹麦磁共振研究中心、放射学与核医学部门) Copenhagen University Hospital– Amager and Hvidovre(哥本哈根大学医院–阿马格和赫维多尔)

专题命中 扩散模型 :diffusion(title,abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10038 2025-06-13 cs.GR cs.AI cs.LG 83%

Ambient Diffusion Omni: Training Good Models with Bad Data

Giannis Daras, Adrian Rodriguez-Munoz, Adam Klivans, Antonio Torralba, Constantinos Daskalakis

机构 * Massachusetts Institute of Technology(麻省理工学院) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.GR

Comments Preprint, work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14398 2025-06-12 cs.CV 83%

Dynamic Negative Guidance of Diffusion Models

Felix Koulischer, Johannes Deleu, Gabriel Raya, Thomas Demeester, Luca Ambrogioni

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Paper accepted at ICLR 2025 (poster). Our implementation is available at https://github.com/FelixKoulischer/Dynamic-Negative-Guidance.git

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.07944 2025-06-12 cs.CV cs.AI 83%

Effective Data Augmentation With Diffusion Models

Brandon Trabucco, Kyle Doherty, Max Gurinas, Ruslan Salakhutdinov

机构 * Carnegie Mellon University(卡内基梅隆大学) MPG Ranch(MPG牧场) University Of Chicago(芝加哥大学) Laboratory Schools(实验室学校)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Update to ICLR 2024 manuscript (https://openreview.net/forum?id=ZWzUA9zeAg), add leafy spurge citations

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07590 2025-06-10 cs.CV cs.LG 83%

Explore the vulnerability of black-box models via diffusion models

Jiacheng Shi, Yanfu Zhang, Huajie Shao, Ashley Gao

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17929 2025-06-10 cs.CV cs.LG 83%

GLASS: Guided Latent Slot Diffusion for Object-Centric Learning

Krishnakant Singh, Simone Schaub-Meyer, Stefan Roth

机构 * Department of Computer Science, TU Darmstadt(图宾根大学计算机科学系)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments CVPR 2025. Project Page: http://visinf.github.io/glass/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05934 2025-06-09 cs.CV cs.AI 83%

FADE: Frequency-Aware Diffusion Model Factorization for Video Editing

Yixuan Zhu, Haolin Wang, Shilin Ma, Wenliang Zhao, Yansong Tang, Lei Chen, Jie Zhou

机构 * Department of Automation, Tsinghua University(自动化系,清华大学) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学)

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

Comments Accepted by IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09625 2025-06-09 cs.CV 83%

Illusion3D: 3D Multiview Illusion with 2D Diffusion Priors

Yue Feng, Vaibhav Sanjay, Spencer Lutz, Badour AlBahar, Songwei Ge, Jia-Bin Huang

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Project page: https://3d-multiview-illusion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02528 2025-06-04 cs.CV 83%

RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers

Yan Gong, Yiren Song, Yicheng Li, Chenglin Li, Yin Zhang

机构 * Zhe Jiang University(浙江大学) National University of Singapore(新加坡国立大学)

专题命中 扩散模型 :diffusion(title,abstract);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02419 2025-06-04 cs.CV 83%

Guiding Registration with Emergent Similarity from Pre-Trained Diffusion Models

Nurislam Tursynbek, Hastings Greer, Basar Demir, Marc Niethammer

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) UCSD(加州大学圣地亚哥分校)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments MICCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02395 2025-06-04 cs.CV 83%

The Devil is in the Darkness: Diffusion-Based Nighttime Dehazing Anchored in Brightness Perception

Xiaofeng Cong, Yu-Xin Zhang, Haoran Wei, Yeying Jin, Junming Hou, Jie Gui, Jing Zhang, Dacheng Tao

机构 * Southeast University(东南大学) UESTC(电子科技大学) Tencent Company(腾讯公司) Wuhan University(武汉大学) Nanyang Technological University(南洋理工大学)

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01539 2025-06-03 cs.CV cs.AI 83%

G4Seg: Generation for Inexact Segmentation Refinement with Diffusion Models

Tianjiao Zhang, Fei Zhang, Jiangchao Yao, Ya Zhang, Yanfeng Wang

机构 * CMIC, Shanghai Jiao Tong University(上海交通大学计算机医学研究院) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) Shanghai Innovation Institute(上海创新研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 16 pages, 12 figures, IEEE International Conference on Multimedia & Expo 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09055 2025-06-03 cs.CV 83%

SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models

Jaerin Lee, Daniel Sungho Jung, Kanggeon Lee, Kyoung Mu Lee

机构 * ASRI, Department of ECE(ASRI电子工程系) Interdisciplinary Program in Artificial Intelligence(人工智能跨学科项目) SNU-LG AI Research Center(首尔国立大学SNU-LG人工智能研究中心)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments CVPR 2025 camera ready

Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04332 2025-06-03 cs.CV 83%

HandCraft: Anatomically Correct Restoration of Malformed Hands in Diffusion Generated Images

Zhenyue Qin, Yiqun Zhang, Yang Liu, Dylan Campbell

机构 * Seeing Machines Australian National University(澳大利亚国立大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments 2025 IEEE/CVF Winter Conference on Applications of Computer Vision (WACV)

Journal ref 2025 IEEE/CVF Winter Conference on Applications of Computer Vision (WACV) 2025 IEEE/CVF Winter Conference on Applications of Computer Vision (WACV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03444 2025-06-02 cs.CV cs.AI cs.LG 83%

Masked Autoencoders Are Effective Tokenizers for Diffusion Models

Hao Chen, Yujin Han, Fangyi Chen, Xiang Li, Yidong Wang, Jindong Wang, Ze Wang, Zicheng Liu, Difan Zou, Bhiksha Raj

专题命中 扩散模型 :diffusion(title,abstract);image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23758 2025-05-30 cs.CV 83%

LoRAShop: Training-Free Multi-Concept Image Generation and Editing with Rectified Flow Transformers

Yusuf Dalva, Hidir Yesiltepe, Pinar Yanardag

机构 * Virginia Tech(弗吉尼亚理工大学)

专题命中 扩散模型 :image generation(title);diffusion(abstract);image editing(abstract);分类 cs.CV

Comments Project Webpage: https://lorashop.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23312 2025-05-30 cs.CV 83%

TRACE: Trajectory-Constrained Concept Erasure in Diffusion Models

Finn Carter

机构 * Shandong University(山东大学)

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments In peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22682 2025-05-30 eess.IV cs.CV physics.med-ph 83%

MRI Image Generation Based on Text Prompts

Xinxian Fan, Mengye Lyu

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02154 2025-05-30 cs.CV 83%

FreSca: Scaling in Frequency Space Enhances Diffusion Models

Chao Huang, Susan Liang, Yunlong Tang, Jing Bi, Li Ma, Yapeng Tian, Chenliang Xu

机构 * University of Rochester(罗切斯特大学) HKUST(香港科技大学) The University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments Project page: https://wikichao.github.io/FreSca/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22569 2025-05-29 cs.CV 83%

ImageReFL: Balancing Quality and Diversity in Human-Aligned Diffusion Models

Dmitrii Sorokin, Maksim Nakhodnov, Andrey Kuznetsov, Aibek Alanov

机构 * HSE University(圣彼得堡国立大学) AIRI Sber Innopolis

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments The source code can be found at https://github.com/ControlGenAI/ImageReFL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22407 2025-05-29 cs.CV 83%

Self-Reflective Reinforcement Learning for Diffusion-based Image Reasoning Generation

Jiadong Pan, Zhiyuan Ma, Kaiyan Zhang, Ning Ding, Bowen Zhou

机构 * Department of Electronic Engineering, Tsinghua University, Beijing, China(电子工程系,清华大学,北京,中国) Shanghai AI Laboratory, Shanghai, China(上海人工智能实验室,上海,中国)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22129 2025-05-29 cs.CV 83%

What Makes for Text to 360-degree Panorama Generation with Stable Diffusion?

Jinhong Ni, Chang-Bin Zhang, Qiang Zhang, Jing Zhang

机构 * Australian National University(澳大利亚国立大学) The University of Hong Kong(香港大学) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06025 2025-05-29 cs.CV cs.LG stat.ML 83%

Shielded Diffusion: Generating Novel and Diverse Images using Sparse Repellency

Michael Kirchhof, James Thornton, Louis Béthune, Pierre Ablin, Eugene Ndiaye, Marco Cuturi

专题命中 扩散模型 :diffusion(title,abstract);text-to-image(abstract);分类 cs.CV

Comments Accepted at ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20723 2025-05-28 cs.CV cs.LG 83%

LeDiFlow: Learned Distribution-guided Flow Matching to Accelerate Image Generation

Pascal Zwick, Nils Friederich, Maximilian Beichter, Lennart Hilbert, Ralf Mikut, Oliver Bringmann

专题命中 扩散模型 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07538 2025-05-28 cs.CV 83%

Selftok: Discrete Visual Tokens of Autoregression, by Diffusion, and for Reasoning

Bohan Wang, Zhongqi Yue, Fengda Zhang, Shuo Chen, Li'an Bi, Junzhe Zhang, Xue Song, Kennard Yanting Chan, Jiachun Pan, Weijia Wu, Mingze Zhou, Wang Lin, Kaihang Pan, Saining Zhang, Liyu Jia, Wentao Hu, Wei Zhao, Hanwang Zhang

机构 * Selftok Team(Selftok团队) Media Technology Institute(媒体技术研究所) Huawei(华为)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06814 2025-05-27 cs.LG cs.AI cs.GR 83%

Diffusion Instruction Tuning

Chen Jin, Ryutaro Tanno, Amrutha Saseendran, Tom Diethe, Philip Teare

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.GR

Comments Project page at https://astrazeneca.github.io/vlm/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18358 2025-05-27 cs.CV 83%

CONCORD: Concept-Informed Diffusion for Dataset Distillation

Jianyang Gu, Haonan Wang, Ruoxi Jia, Saeed Vahidian, Vyacheslav Kungurtsev, Wei Jiang, Yiran Chen

机构 * The Ohio State University(俄亥俄州立大学) National University of Singapore(新加坡国立大学) Virginia Tech(弗吉尼亚理工大学) Duke University(杜克大学) Czech Technical University(捷克技术大学) Zhejiang University(浙江大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17311 2025-05-26 cs.CV cs.LG 83%

Harnessing EHRs for Diffusion-based Anomaly Detection on Chest X-rays

Harim Kim, Yuhan Wang, Minkyu Ahn, Heeyoul Choi, Yuyin Zhou, Charmgil Hong

机构 * Handong Global University(Handong Global大学) University of California, Santa Cruz(加州大学圣克鲁兹分校)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

Comments MICCAI 2025 early accept

详情

展开后加载摘要…

URL PDF HTML 收藏