Mobile Video Diffusion
移动视频扩散
机构 * Qualcomm AI Research(高通人工智能研究)
专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV
AI总结 本文提出了一种移动优化的视频扩散模型MobileVD,通过降低帧分辨率、引入多尺度时间表示和两种新的剪枝方案,显著降低了内存和计算成本,同时在移动设备上实现了高效的视频生成。
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
移动视频扩散
机构 * Qualcomm AI Research(高通人工智能研究)
专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV
AI总结 本文提出了一种移动优化的视频扩散模型MobileVD,通过降低帧分辨率、引入多尺度时间表示和两种新的剪枝方案,显著降低了内存和计算成本,同时在移动设备上实现了高效的视频生成。
物理的隐形之手:当视频扩散模型知道的比它们展示的更多
机构 * University of Bristol(布里斯托大学) ; McGill University(麦吉尔大学) ; Mila–Quebec AI Institute(魁北克AI研究院) ; Microsoft Research(微软研究院) ; University of Calgary(卡尔加里大学)
专题命中 视频扩散模型 :video diffusion(title,abstract);分类 cs.CV
AI总结 通过逆向扩散过程探测视频扩散模型的潜在轨迹,发现物理合理性可以从扩散变换器状态中线性解码,准确率达81.27%,表明物理有意义的表示是生成式去噪的副产品。