机构
*
State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing, Wuhan University(武汉大学测绘遥感信息工程国家重点实验室)
;
School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院)
;
School of Computer Science, Wuhan University(武汉大学计算机学院)
;
Zhongguancun Academy(中关村学院)
;
Graduate School of Frontier Sciences, The University of Tokyo(东京大学新领域创成科学研究科)
;
Department of Computer Science, Stanford University(斯坦福大学计算机科学系)
When Test-Time Guidance Is Enough: Fast Image and Video Editing with Diffusion Guidance
测试时指导足矣:基于扩散指导的快速图像和视频编辑
Ahmed Ghorbel, Badr Moufad, Navid Bagheri Shouraki, Alain Oliviero Durmus, Thomas Hirtz, Eric Moulines, Jimmy Olsson, Yazid Janati
机构
*
CMAP, Ecole Polytechnique(巴黎综合理工学院CMAP实验室)
;
Institute of Foundation Models(基础模型研究所)
;
MBZUAI(穆罕默德·本·扎耶德人工智能大学)
;
EPITA(法国高等信息技术学院)
;
Sorbonne University(索邦大学)
;
Lagrange Mathematics and Computing Research Center(拉格朗日数学与计算研究中心)
;
EPITA Research Lab(EPITA研究实验室)
;
KTH Royal Institute of Technology(瑞典皇家理工学院)
PoseDreamer: Scalable and Photorealistic Human Data Generation Pipeline with Diffusion Models
PoseDreamer:基于扩散模型的可扩展且逼真的人体数据生成管道
Lorenza Prospero, Orest Kupyn, Ostap Viniavskyi, João F. Henriques, Christian Rupprecht
机构
*
The Podium Institute for Sports Medicine and Technology, University of Oxford(牛津大学体育医学与技术讲台研究所)
;
Visual Geometry Group, University of Oxford(牛津大学视觉几何组)
;
Ukrainian Catholic University(乌克兰天主教大学)
机构
*
Institute of Information Engineering, CAS(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)
;
State Key Laboratory of AI Safety, Institute of Computing Technology, CAS(中国科学院计算技术研究所人工智能安全国家重点实验室)
;
School of Cyber Science and Tech., Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区网络空间安全学院)
;
Alibaba Group(阿里巴巴集团)
;
School of Computer Science and Tech., University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院)
;
Key Laboratory of Big Data Mining and Knowledge Management, CAS(中国科学院大数据挖掘与知识管理重点实验室)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
CardioDiT: Latent Diffusion Transformers for 4D Cardiac MRI Synthesis
CardioDiT:用于4D心脏MRI合成的潜在扩散变换器
Marvin Seyfarth, Sarah Kaye Müller, Arman Ghanaat, Isabelle Ayx, Fabian Fastenrath, Philipp Wild, Alexander Hertel, Theano Papavassiliu, Salman Ul Hassan Dar, Sandy Engelhardt
机构
*
Institute for Artificial Intelligence in Cardiovascular Medicine, Medical Faculty of Heidelberg University, Heidelberg University(海德堡大学医学院心血管医学人工智能研究所,海德堡大学)
;
Department of Cardiology, Angiology, Pneumology, Heidelberg University Hospital(海德堡大学医院心脏病学、血管学、肺病学系)
;
DZHK (German Centre for Cardiovascular Research), Partner Site Heidelberg/Mannheim(德国心血管研究中心(DZHK),海德堡/曼海姆合作站点)
;
Department of Radiology and Nuclear Medicine, University Medical Center Mannheim(曼海姆大学医学中心放射学与核医学系)
;
Section for Invasive Cardiology and Electrophysiology, I. Medical Department, Cardiology, Hemostasiology and Intensive Care, University Medical Centre Mannheim(曼海姆大学医学中心第一内科(心脏病学、止血学与重症监护)介入心脏病学与电生理学科)
;
University Medical Center of the Johannes Gutenberg-University Mainz(美因茨约翰内斯·古腾堡大学医学中心)
;
Department of Cardiology, Angiology, Hemostasis, and Medical Intensive Care, University Medical Centre Mannheim, Medical Faculty Mannheim, University of Heidelberg(海德堡大学曼海姆医学院曼海姆大学医学中心心脏病学、血管学、止血学与内科重症监护系)
DMAligner: Enhancing Image Alignment via Diffusion Model Based View Synthesis
DMAligner:通过扩散模型基于视角合成增强图像对齐
Xinglong Luo, Ao Luo, Zhengning Wang, Yueqi Yang, Chaoyu Feng, Lei Lei, Bing Zeng, Shuaicheng Liu
机构
*
University of Electronic Science and Technology of China(电子科技大学)
;
Qianyuan Laboratory(钱元实验室)
;
Southwest Jiaotong University(西南交通大学)
;
Independent Researcher(独立研究者)
Unified Diffusion VLA: Vision-Language-Action Model via Joint Discrete Denoising Diffusion Process
统一扩散VLA:通过联合离散去噪扩散过程实现视觉-语言-动作模型
Jiayi Chen, Wenxuan Song, Pengxiang Ding, Ziyang Zhou, Han Zhao, Feilong Tang, Donglin Wang, Haoang Li
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
Westlake University(西交大学)
;
Zhejiang University(浙江大学)
;
Monash University(墨尔本大学)
Dinglun He, Baoming Zhang, Xu Wang, Yao Hao, Deshan Yang, Ye Duan
机构
*
Department of Electrical Engineering and Computer Science, University of Missouri, Columbia, MO, USA(密苏里大学电气工程与计算机科学系)
;
Department of Computer Science, The University of Texas at Dallas, Richardson, TX, USA(德克萨斯大学达拉斯分校计算机科学系)
;
Department of Radiation Oncology, Washington University in St. Louis, MO, USA(华盛顿大学圣路易斯分校放射肿瘤学系)
;
Department of Radiation Oncology, Duke University, Durham, NC, USA(达特茅斯大学放射肿瘤学系)
;
School of Computing, Clemson University, Clemson, SC, USA(克莱姆森大学计算机科学学院)
DA-VAE: Plug-in Latent Compression for Diffusion via Detail Alignment
DA-VAE:通过细节对齐实现扩散模型的插件式潜在压缩
Xin Cai, Zhiyuan You, Zhoutong Zhang, Tianfan Xue
机构
*
Multimedia Laboratory, The Chinese University of Hong Kong(香港中文大学多媒体实验室)
;
Adobe NextCam
;
Shanghai AI Laboratory(上海人工智能实验室)
;
CPII under InnoHK(创新香港下的CPII)