arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-21 至 2026-08-21 共收录 55 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 55 篇

2608.20334 2026-08-21 cs.CV 新提交 85%

Swift-Image: Exploring the Performance Frontier of Compact Unified Image Generation Models

Swift-Image:探索紧凑统一图像生成模型的性能前沿

Taihang Hu, Zhao Wang, Zuan Gao, Tao Liu, Hao Yan, Zhengze Xu, Yuhang Yu, Yongchao Du, Xingjian Wang, Jun Zheng, Qinye Zhou, Zhengrui Chen, Chao Lin, Yefeng Shen, Zhengtao Wu, Ge Wu, Xiaoli Xu, Denghui Yang, Huayu Zhang, Mingzhou Zhang, Mengting Chen

专题命中 扩散模型 :image generation(title,abstract);text-to-image(abstract);image editing(abstract);分类 cs.CV

AI总结 本研究提出紧凑统一图像生成模型Swift-Image,采用6B单流DiT等技术,实现领先综合性能,压缩后3B模型无明显损失,还总结了相关实用经验。

Comments 28 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19504 2026-08-21 cs.CV 新提交 83%

A Plug-in Interpretation of Conditioning in Score-Based Diffusion Models

基于分数的扩散模型中条件作用的插件式解释

Libo Chen, Souvik Ghosh, Teo Deveney, Chris Budd, Vinay P. Namboodiri

机构 * International Institute of Information Technology Hyderabad(国际信息技术学院海得拉巴分校) University of Bath(巴斯大学)

专题命中 扩散模型 :diffusion(title,abstract);image generation(abstract);分类 cs.CV

AI总结 该研究提出基于多速度联合扩散的插件式条件机制,推导相关SDE与ODE并引入对数福克-普朗克残差正则化,在条件图像生成任务中验证了方法的有效性。

Comments Accepted at BMVC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20308 2026-08-21 cs.CV 新提交 79%

DreamHand: Repurposing Video Diffusion Models for Occlusion-Robust Egocentric 3D Hand Motion Recovery

DreamHand:复用视频扩散模型实现遮挡鲁棒的第一人称视角3D手部运动恢复

Yufei Liu, Xixi Wang, Hao Li, Ganlong Zhao, Kaitong Cai, Chengkai Jin, Chunxiao Liu, Jianbo Liu, Siyuan Huang, Xingang Pan, Hongsheng Li

机构 * ACE Robotics(ACE机器人公司) Nanyang Technological University(南洋理工大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DreamHand是复用视频扩散模型的离线片段级框架,通过确定性干净潜在编码器与双向时空解码器恢复带度量位置的连续双手轨迹,在五个第一人称视角基准测试中实现最佳性能,为机器人操作数据提供可扩展路径。

Comments Project Page: this https URL (https://ggxxii.github.io/dreamhand/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19871 2026-08-21 cs.CV 新提交 79%

DIFFCZSL: Compositional Zero-Shot Learning Regularized by Diffusion Representations

DIFFCZSL:基于扩散表示正则化的组合零样本学习

Hangyu Tian, Zhenqi He, Yanghao Wang, Long Chen

机构 * The Hong Kong University of Science and Technology(香港科技大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 DIFFCZSL将预训练扩散模型的生成先验注入基于CLIP的组合零样本学习流程,通过对比对齐提升性能,在两类设置下均优于强基线,凸显了扩散表示与视觉-语言模型的互补优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19644 2026-08-21 cs.CV 新提交 79%

When Guidance Goes Off-Scale: Recalibrating Diffusion Transformers under Analog Compute-in-Memory Nonidealities

当引导超出规模:模拟存算非理想性下的扩散变换器重新校准

Wenshuai Yao, Wenyong Zhou

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 该研究针对模拟存算非理想性下扩散变换器的CFG残差问题,提出采样器侧引导尺度重新校准方法,可大幅消除CIM导致的FID差距,提升生成质量。

Comments 9 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19567 2026-08-21 cs.CV 新提交 79%

Block3D: Efficient Text-to-3D Generation via Block-Wise Diffusion

Block3D:基于分块扩散的高效文本到3D生成

Bowen Cui, Weijie Wang, Zeyu Zhang, Yefei He, Mingda Lin, Haoyu Zhao, Yuanyu He, Donny Y. Chen, Feng Chen, Bohan Zhuang

机构 * ZipLab, Zhejiang University(浙江大学ZipLab) University of California, Berkeley(加州大学伯克利分校) Wuhan University(武汉大学) Monash University(莫纳什大学) University of Adelaide(阿德莱德大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 针对文本到3D生成成本高的问题,提出Block3D分块扩散框架,通过分块生成、联合去噪及置信度引导的块内修正,在保持几何保真度的同时实现5.15倍的速度提升。

Comments Project page: this https URL (https://alexandertsui.github.io/block3d/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19556 2026-08-21 cs.CV cs.AI 新提交 79%

Stream4D: 4D-Consistency for Streaming Autoregressive Diffusion Video Models

Stream4D:面向流式自回归扩散视频模型的4D一致性

Yuanhao Ban, Jiaqi Feng, Hengguang Zhou, Xiaohuan Pei, Justin Cui, Cho-Jui Hsieh

机构 * UCLA(加州大学洛杉矶分校) Tsinghua University(清华大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Stream4D用显式建模场景动力学的前馈4D重建奖励替代静态评判器,结合运动先验与感知锚,提升流式自回归扩散视频模型的4D重建质量、运动保留效果及人类对齐偏好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22700 2026-08-21 cs.CV 版本更新 79%

4DLoG: Generative Modeling of Neurodegenerative Brain Anatomy with 4D Longitudinal Diffusion Model

利用4D纵向扩散模型生成神经退行性脑解剖结构

Nivetha Jayakumar, Swakshar Deb, Bahram Jafrasteh, Qingyu Zhao, Miaomiao Zhang

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) Department of Radiology(放射学系) Department of Electrical and Computer Engineering, Department of Computer Science(电气与计算机工程系、计算机科学系)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种4D纵向扩散模型,用于生成神经退行性疾病的脑解剖结构,通过临床变量条件生成准确的脑部变化轨迹,验证了其在疾病分类和分割中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18400 2026-08-21 eess.IV cs.CV 版本更新 79%

Exploiting Completeness Perception with Diffusion Transformer for Unified 3D MRI Synthesis

利用扩散变换器的完整性感知实现统一的3D MRI合成

Junkai Liu, Nay Aung, Theodoros N. Arvanitis, Joao A. C. Lima, Steffen E. Petersen, Le Zhang

机构 * School of Engineering, University of Birmingham, UK(伯明翰大学工程学院) William Harvey Research Institute, Queen Mary University London, UK(女王玛丽大学伦敦威廉·哈里维研究所) Barts Heart Centre, St Bartholomew’s Hospital, Barts Health NHS Trust, UK(巴特勒心脏中心,圣巴塞洛缪医院,巴特勒健康 NHS信托) Division of Cardiology, Johns Hopkins University School of Medicine, US(约翰霍普金斯大学医学院心脏病科)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出CoPeDiT模型,通过完整性感知机制提升3D MRI合成的语义一致性与鲁棒性。

Comments Accepted to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15648 2026-08-21 cs.LG cs.CE cs.CV 版本更新 79%

Guided Diffusion by Optimized Loss Functions on Relaxed Parameters for Inverse Material Design

通过放松参数优化损失函数引导扩散用于逆材料设计

Jens U. Kreber, Christian Weißenfels, Joerg Stueckler

机构 * Intelligent Perception in Technical Systems Group, University of Augsburg, Germany(技术系统智能感知组,乌尔姆大学,德国) Faculty of Mathematics, Natural Science and Engineering, University of Augsburg, Germany(数学、自然科学与工程学院,乌尔姆大学,德国) Centre for Advanced Analytics and Predictive Sciences, University of Augsburg, Germany(高级分析与预测科学中心,乌尔姆大学,德国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 通过优化损失函数引导扩散模型,用于逆材料设计,实现高效且多样化的设计生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05441 2026-08-21 cs.CV cs.LG 版本更新 79%

Decoupling High and Low Frequencies for Faithful Image Generation with Fine Details

解耦高低频以生成具有精细细节的忠实图像

Tejaswini Medi, Hsien-Yi Wang, Arianna Rampini, Margret Keuper

机构 * University of Mannheim(曼海姆大学) Autodesk AI Lab(Autodesk人工智能实验室) MPI for Informatics(信息研究所)

专题命中 扩散模型 :image generation(title);diffusion(abstract);分类 cs.CV

AI总结 该研究针对潜在生成模型难以恢复图像高频细节的问题,提出DeBaT解耦频带分词器,将其集成到潜在扩散模型后,可生成更锐利、更真实的图像样本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20123 2026-08-21 stat.ML cs.LG 新提交 78%

Discrete Diffusion Inference-Time Control with Nested Sequential Monte Carlo

基于嵌套序贯蒙特卡洛的离散扩散推理时控制

Lohithsai Yadala Chanchu, Hany Abdulsamad, Christian A. Naesseth

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究针对离散扩散语言模型文本生成的推理时控制问题,提出NSMC与FA-NSMC方法,修正了现有粒子方法的缺陷,在毒性和流畅度引导任务上表现优于n-best采样与bootstrap SMC。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19809 2026-08-21 cs.SI 新提交 78%

From Latent Influence to Language: Diffusion-Oriented Content Generation via Audience-Susceptible Features

从潜在影响到语言:面向扩散的受众易感特征内容生成

Jiaying Lei, Shengqi Dang, Runqian Bai, Ziqing Qian, Nan Cao

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对现有面向扩散的内容生成方法难以转化扩散影响信号的问题,提出三阶段框架DOCG-AS,实验显示其在预测扩散影响上优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19804 2026-08-21 cs.AI 新提交 78%

ADAPT: Physics-Aware Diffusion-based World Models for Adaptive Predictive Transferable HVAC Control

ADAPT:面向自适应可迁移HVAC控制的物理感知扩散式世界模型

Xu Yang, Kailai Sun, Dianyu Zhong, Qianchuan Zhao

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文针对现有HVAC控制方法泛化性差的问题,提出物理感知扩散世界模型ADAPT,在IID控制下可降HVAC能耗7.3%、不适度30.2%,OOD场景下迁移鲁棒性显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19368 2026-08-21 math.NA 新提交 78%

A High-Order Rank-Adaptive Implicit Algorithm for Solving High Dimensional Diffusion Equations using the Hierarchical Tucker Decomposition

基于分层塔克分解求解高维扩散方程的高阶秩自适应隐式算法

Paolo Bosques-Paulet

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出采用分层塔克分解的高阶秩自适应隐式算法,用于求解高维扩散方程,通过数值实验验证其高阶精度及解秩捕获能力。

Comments This work was done while PBP was an undergraduate at Swarthmore College. Project Advisor: Dr. Joseph Nakao (Swarthmore College)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20196 2026-08-21 hep-ph hep-th nucl-th 新提交 78%

Negative diffusion in the Functional Renormalization Group flow for the Quark-Diquark Model

夸克-双夸克模型的泛函重整化群流中的负扩散

Johannes Poeplau, Ashutosh Dash, Dirk H. Rischke

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究针对夸克-双夸克模型泛函重整化群流中低温大化学势下的负扩散问题,证明其为模型特性,提出超扩散正则化方案以消除振荡,为研究QCD相图相关现象提供可靠方法。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18764 2026-08-21 cs.IR 版本更新 78%

GateDiffInt: Gate-Mediated Controllable Diffusion and Multi-Intent LLM Distillation for User Behavior Modeling

GateDiffInt:用于用户行为建模的门控介导可控扩散与多意图大语言模型蒸馏

Jialong Duan, Zichen Zhang, Zirui Tu, Zheng Zhang, Zepeng Li, Qingyao Cui, Qinwen Wang, Yudan Liu, Luo Yang, Yao Hu

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对现有排序模型难以解耦结构化意图的问题,提出GateDiffInt框架,通过可控扩散与LLM蒸馏实现意图感知表示,在公开及工业数据集和线上测试中均取得显著效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13123 2026-08-21 physics.comp-ph cond-mat.stat-mech 版本更新 78%

Using Diffusion Models to Estimate Uncertainties in Analytic Continuation

利用扩散模型估计解析延拓中的不确定性

Sagi Meir, Daniel Freedman, Barak Hirshberg

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究提出基于扩散模型的解析延拓框架,可量化解析延拓的不确定性,还能评估逆问题固有难度,在液态仲氢模拟数据应用中取得了良好效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13193 2026-08-21 physics.flu-dyn 版本更新 78%

Generating synthetic evolution of turbulent flames with an experimental data-based spatiotemporal diffusion model

用基于实验数据的时空扩散模型生成湍流火焰的合成演化

Amrit Tarur, Shivam Barwey

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究开发条件扩散模型,结合 x 预测流匹配框架及时空变压器,生成湍流火焰合成轨迹,能保留关键特征与统计一致性,还进行过渡合成外推任务,为数据稀疏环境下的数据探索提供新途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22950 2026-08-21 stat.ML cs.LG math.ST stat.ME 版本更新 78%

Diffusion-based Denoising Beats Vanilla Score Matching in Parameter Estimation: A Theoretical Explanation

基于扩散的去噪在参数估计中优于普通得分匹配:一个理论解释

Benedikt Lütke Schwienhorst, Nadja Klein, Johannes Lederer

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文通过理论分析证明,对于具有分离模态的多峰分布,基于扩散的去噪得分匹配估计器(DDSME)相比普通得分匹配估计器(SME)具有更优的误差界,并解释了扩散方法优越性的原因。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18738 2026-08-21 cs.CL 版本更新 78%

Remask, Don't Replace: Token-to-Mask Refinement in Diffusion Language Models

重新标记,而非替换:扩散大语言模型中的令牌到标记细化

Lin Yao

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Zhongguancun Academy(中关村学院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出Token-to-Mask(T2M)方法,通过重新标记可疑令牌而非覆盖来提升扩散大语言模型的准确性,在AIME 2025和CMATH上分别提升13.33和8.56个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18779 2026-08-21 cs.RO 版本更新 78%

DiffDef: A Diffusion Model for Generating Multimodal Goal Shapes From Demonstrations for Deformable Object Manipulation

DiffDef:一种用于从演示中生成可变形物体操纵的多模态目标形状的扩散模型

Bao Thach, Tanner Watts, Siyeon Kim, Britton Jordan, Mohanraj Shanthi, Shing-Hei Ho, James M. Ferguson, Tucker Hermans, Alan Kuntz

机构 * Robotics Center and Kahlert School of Computing, University of Utah(大学计算机学院和机器人中心,犹他大学) NVIDIA Corporation(英伟达公司)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对现有可变形物体操纵方法依赖不切实际的目标获取方式、无法处理多模态目标的问题,提出DiffDef扩散模型,学习可行目标形状分布,在仿真和两种物理机器人平台上验证其可提升任务性能。

Comments Published and presented at ICRA 2026. 8 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15955 2026-08-21 math.ST math.PR q-bio.PE 版本更新 78%

The mutual arrangement of Wright-Fisher diffusion path measures and its impact on parameter estimation

Wright-Fisher扩散路径测度的相互排列及其对参数估计的影响

Paul A. Jenkins

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究Wright-Fisher扩散路径测度的相互排列,确定其分离时间,推导突变与选择参数的联合最大似然估计量,扩展了经典结果并建立相关零一律。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19571 2026-08-21 math.AP 新提交 71%

Gradient regularity and potential estimates for fractional drift--diffusion equations in the critical and subcritical ranges

临界与次临界范围内分数阶漂移扩散方程的梯度正则性与位势估计

Qi Xue, Chao Zhang

专题命中 扩散模型 :diffusion(title)

AI总结 该研究针对s∈[1/2,1)的分数阶漂移扩散方程,建立了粘性解的梯度正则性与位势估计,推导了相关稳定性结果及全空间核的极限性质,明确了漂移到边界时的障碍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19384 2026-08-21 math.NA 新提交 71%

A high-order, meshless, Lagrangian--Eulerian RBF-FD method for advection--diffusion--reaction on moving manifolds

用于移动流形上平流-扩散-反应问题的高阶无网格拉格朗日-欧拉RBF-FD方法

Matthew Lowery, Grady B. Wright, Varun Shankar

专题命中 扩散模型 :diffusion(title)

AI总结 该研究提出一种高阶无网格拉格朗日-欧拉RBF-FD方法,用于求解三维移动流形上的平流-扩散-反应偏微分方程,通过多种策略提升稳定性与效率,数值实验验证了其收敛性、守恒性与长期积分稳定性。

Comments 27 pages + 12 page appendix, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17125 2026-08-21 cond-mat.supr-con cond-mat.mes-hall physics.app-ph 版本更新 71%

Demonstration of a scalable all-solid-state refrigerator exploiting diffusion geometries and limiting interfacial conductances at temperatures below 1 kelvin

利用扩散几何结构和界面限域电导的可扩展全固态冰箱在1开尔文以下温度的演示

Northrop Grumman Microelectronics Design, Applications Team: Robert M. Young, Zachary Stegen, John X. Przybysz, Edward R. Engbrecht, Aaron A. Hathaway, Justin C. Hackley, Kirby B. Myers, Christian C. Thorpe, Aurelius L. Graninger, Robert Miller, Diego A. Morales, Roberto D. Carcamo, Glen Walters, Jeric P. Sarad, Nicholas F. Pleim, Seth Whitsitt, Joshua T. Shipman, Anil Erol, Melissa G. Loving, Evan Donohue, Corey A. Kegerreis, Benjamin Dalfort, Moe S. Khalil, Christopher Pinion, Randi Jaramillo, John Milinichik, Sandro J. Di Giacomo, Thomas Zodda, Nilesh Tralshawala, Gregory R. Boyd, Jonathan M. Cochran, Katherine A. Maddock, Michael P. De Feo, Aaron A.Pesetski, Marc E. Sherwin

专题命中 扩散模型 :diffusion(title)

AI总结 该研究开发了采用NIS结、含1121个SINIS单元的可扩展全固态冰箱,首次实现了低于1开尔文下对整个硅芯片的冷却,将其声子温度降至70毫开尔文。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22674 2026-08-21 cs.GR cs.CV cs.HC 版本更新 62%

Text-based Tactile Graphics Generation for the Visually Impaired

为视障人士生成基于文本的触觉图形

Ruihan Gao, Joonghyuk Shin, Ava Pun, Jaesik Park, Wenzhen Yuan, Jun-Yan Zhu

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV、cs.GR

AI总结 研究为视障人士开发基于文本生成触觉图形的集成系统,引入制作感知技术,能联合生成多种元素,经评估和用户研究,结果优于基线,拓宽了生成式AI对视障群体及其他人的可及性。

Comments ECCV 2026, Project webpage: this https URL (https://ruihangao.github.io/Text2TactileGraphics/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20335 2026-08-21 cs.CV 新提交 57%

4DAnyone: Create Anyone in 4D from a Casual Monocular Video

4DAnyone:从随意的单目视频中创建4D虚拟人物

Yudong Jin, Tao Xie, Qihang Zhang, Zehong Shen, Zhen Xu, Yujun Shen, Hujun Bao, Xiaowei Zhou, Yinghao Xu

机构 * State Key Lab of CAD&CG, Zhejiang University(浙江大学CAD&CG国家重点实验室) Robbyant Chinese University of Hong Kong(香港中文大学) Ant Group(蚂蚁集团) Hong Kong University of Science and Technology(香港科技大学)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 4DAnyone是一种从单目视频重建4D人体的框架,通过RCP和TCR解决多视图一致性问题,在相关数据集上优于现有方法且泛化性好。

Comments Project page: this https URL (https://4danyone.github.io)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19965 2026-08-21 cs.CV cs.LG q-bio.QM 新提交 57%

Flow Matching Meets 3D Curvilinear Structure Segmentation in Medical Imaging

流匹配在医学影像三维曲线结构分割中的应用

Sidi Mohamed Sid'El Moctar, Nicolas Vitry, Hélène Bouvrais

机构 * CNRS(法国国家科学研究中心) Univ. Rennes(雷恩大学) Institute of Genetics and Development of Rennes (IGDR)(雷恩遗传与发育研究所)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本研究提出基于流匹配的3D-CurvSegFlow模型,用于三维医学图像的曲线结构分割,在三个不同公开数据集上的表现优于通用及血管专用方法,为医学图像分析提供高效泛化的新方向。

Comments International Workshop on Machine Learning in Medical Imaging (MLMI 2026) @ MICCAI

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19900 2026-08-21 cs.CV 新提交 57%

AvatarDynamizer: From Static to Dynamic Human Avatars via Generative Dynamic Textures

AvatarDynamizer:通过生成式动态纹理从静态化身到动态人类化身

Guoxing Sun, Heming Zhu, Linjie Lyu, Pascal Fua, Christian Theobalt, Marc Habermann

机构 * Max Planck Institute for Informatics(马克斯·普朗克信息学研究所) EPFL(洛桑联邦理工学院) VIA Research Center(VIA研究中心)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 AvatarDynamizer是一种生成式方法,可将现成静态3D化身转为可控多视角一致4D化身,通过纹理空间动态嵌入实现真实表面动态,在视觉保真度上优于通用方法。

Comments Project page: this https URL (https://vcai.mpi-inf.mpg.de/projects/AvatarDynamizer)

详情

展开后加载摘要…

URL PDF HTML 收藏