SIFT: Self-Imagination Fine-Tuning for Physically Plausible Motion in Video Diffusion Models
SIFT: 视频扩散模型中物理合理运动的自我想象微调
机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) ; Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院(TeleAI)) ; School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院)
专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV
AI总结 针对视频扩散模型生成运动物理不合理的问题,提出自我想象微调(SIFT)范式,通过从模型自身生成视频学习而非直接重建真实视频,结合运动感知判别监督和渐进式难例重放策略,提升运动解耦与物理真实性。
Comments ECCV 2026