Towards motion from video diffusion models
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);text-to-video(abstract);分类 cs.CV
Comments Accepted at ECCV 2024 Workshop :Foundation Models for 3D Humans
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);text-to-video(abstract);分类 cs.CV
Comments Accepted at ECCV 2024 Workshop :Foundation Models for 3D Humans
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);text-to-video(abstract);分类 cs.CV
Comments https://github.com/ndrwmlnk/Awesome-Video-Diffusion-Models
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);long video(abstract);分类 cs.CV
Comments Code at https://github.com/Yaofang-Liu/FVDM
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);video understanding(abstract);分类 cs.CV
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);text-to-video(abstract);分类 cs.CV
Comments Project page: https://tianxingwu.github.io/pages/FreeInit/ Code: https://github.com/TianxingWu/FreeInit
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);long video(abstract);分类 cs.CV
Comments Code will be available at https://github.com/Dawn-LX/Causal-VideoGen
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);text-to-video(abstract);分类 cs.CV
Comments Accepted by CVPR 2024. Project page: https://bivdiff.github.io; GitHub repository: https://github.com/MCG-NJU/BIVDiff
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);long video(abstract);分类 cs.CV
Comments Project page is available at https://hxngiee.github.io/HVDM/
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);text-to-video(abstract);分类 cs.CV
Comments ICCV 2023. Project webpage: https://research.nvidia.com/labs/dir/pyoco
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);long video(abstract);分类 cs.CV
Comments ICLR 2024, Project Page: http://haonanqiu.com/projects/FreeNoise.html, Code Repo: https://github.com/AILab-CVC/FreeNoise
专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(abstract);text-to-video(abstract);分类 cs.CV
Comments Project website https://walt-video-diffusion.github.io/
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);text-to-video(abstract);分类 cs.CV
Comments Project Page: https://vvictoryuki.github.io/animatezero.github.io/
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);text-to-video(abstract);分类 cs.CV
专题命中 视频扩散模型 :video generation(title,abstract);text-to-video(abstract);long video(abstract);分类 cs.CV
Comments Project webpage: https://vchitect.github.io/LaVie-project/
专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(abstract);text-to-video(abstract);分类 cs.CV
Vivid-VR:基于文本到视频扩散变换器的文本概念蒸馏用于逼真视频修复
机构 * Alibaba Group - Taobao & Tmall Group(阿里巴巴集团 - 淘宝天猫集团)
专题命中 视频扩散模型 :video diffusion(title);text-to-video(title);分类 cs.CV
AI总结 本文提出Vivid-VR,通过文本到视频基础模型生成视频修复方法,利用ControlNet控制生成过程以保持内容一致性。为解决传统微调中的分布偏移问题,提出概念蒸馏策略,通过预训练T2V模型合成带文本概念的训练样本,提升纹理和时间一致性。
Comments Accepted by ICLR 2026; ICLR version of the paper: https://openreview.net/pdf?id=YV5Zgv8pdg
HiAR:通过分层去噪实现高效的自回归长视频生成
专题命中 视频扩散模型 :video generation(title);long video(title);分类 cs.CV
AI总结 HiAR通过分层去噪框架在保持时间连续性的同时减少误差传播,实现高效长视频生成。
Comments Project page: https://jacky-hate.github.io/HiAR/ Code: https://github.com/Jacky-hate/HiAR
NEGATE: 用于文本到视频扩散中的语义约束指导以处理语言否定
机构 * University of Maryland at College Park(马里兰大学 College Park 分校)
专题命中 视频扩散模型 :video diffusion(title);text-to-video(title);分类 cs.CV
AI总结 本文提出了一种基于扩散模型的语义约束指导方法,用于处理文本到视频生成中的语言否定问题,通过结构化约束实现否定的统一建模。
Comments 50 pages, 32 figures
机构 * PRIS, School of Artificial Intelligence, Beijing University of Posts(PRIS人工智能学院,北京邮电大学) ; SketchX, CVSSP, University of Surrey(SketchX,计算机视觉与模式识别研究所,萨里大学)
专题命中 视频扩散模型 :video diffusion(title);text-to-video(title);分类 cs.CV
Comments 2024 IEEE International Conference on Visual Communications and Image Processing (VCIP); Oral
Steady-Forcing: 长时程自然视频扩散中空间持久性与运动连续性的平衡
机构 * Department of Computer Science and Engineering, Sogang University(西江大学计算机科学与工程系) ; Department of Artificial Intelligence, Sogang University(西江大学人工智能系)
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV、cs.MM
AI总结 提出Steady-Forcing框架,通过视觉锚点、运动记忆和蒸馏等技术,在长时程固定相机自然视频生成中平衡背景稳定与运动连续性,优于现有方法。
Comments Project page: https://minar09.github.io/steadyforcing/
迈向3D感知视频扩散模型:基于网格标记化的无渲染人体运动控制
机构 * DAMO Academy, Alibaba Group(阿里巴巴集团大模型实验室) ; Hupan Lab(虎盘实验室) ; Zhejiang University(浙江大学) ; INSAIT
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV、eess.IV
AI总结 提出一种无渲染框架,通过压缩的3D人体网格标记直接条件化视频生成,实现精确的人体运动控制,减少2D引导伪影并提升3D结构建模能力。
Comments Project page: https://jingyunliang.github.io/MeshToken/
AttentionBender: 在视频扩散变换器中操纵交叉注意力作为创造性探测工具
机构 * University of the Arts London(伦敦艺术大学)
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV、cs.MM
AI总结 AttentionBender通过操纵视频扩散变换器中的交叉注意力,帮助艺术家探索黑箱视频生成的内部机制,揭示交叉注意力的高度交织特性,并产生新的美学效果。
Comments To appear in the Proceedings of the 2026 ACM Creativity and Cognition (C&C '26). 15 pages, 19 figures
视频扩散时间步中的运动编码表征
机构 * University of Maryland(马里兰大学)
专题命中 视频扩散模型 :video diffusion(title,abstract);text-to-video(abstract);分类 cs.CV、eess.IV
AI总结 本文通过分析视频扩散模型中时间步的运动与外观编码特性,发现早期时间步主导运动,后期主导外观,并提出受限于运动主导阶段的运动定制方法。
Comments 10 pages, 4 figures
机构 * Snap Inc. ; Northeastern University(东北大学)
专题命中 视频扩散模型 :video diffusion(title);video generation(abstract);text-to-video(abstract);分类 cs.CV、eess.IV
Comments 17 pages, 6 figures, 9 tables
机构 * The University of Sydney, Sydney, Australia(悉尼大学) ; The University of Hong Kong, Hong Kong SAR, China(香港大学) ; The Chinese University of Hong Kong, Hong Kong SAR, China(香港中文大学)
专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV、cs.MM
Comments MICCAI 2025
机构 * NVIDIA ; Seoul National University(首尔国立大学)
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV、eess.IV
Comments Project page: https://research.nvidia.com/labs/dair/geoman
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV、eess.IV
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV、cs.MM
Comments ACM Multimedia 2024. Source code is available at \url{https://github.com/yanghb22-fdu/Hi3D-Official}
专题命中 视频扩散模型 :video diffusion(title,abstract);video generation(abstract);分类 cs.CV、eess.IV
专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV、eess.IV