Inference Optimization of Foundation Models on AI Accelerators
专题命中 视频生成 :video generation(abstract)
Comments [v2] Tutorial website added [v1] Tutorial published at KDD 2024. Camera-ready version
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
专题命中 视频生成 :video generation(abstract)
Comments [v2] Tutorial website added [v1] Tutorial published at KDD 2024. Camera-ready version
专题命中 视频生成 :text-to-video(abstract)
Comments 9 pages, 5 figures, ACM Multimedia 2024, https://www.robots.ox.ac.uk/~vgg/research/audio-retrieval/dtu/
专题命中 视频生成 :video generation(abstract)
专题命中 视频生成 :text-to-video(abstract)
Comments 27 pages, 3 figures, 7 tables, 2 authors; first author* corresponding author,
专题命中 视频生成 :video generation(abstract)
专题命中 视频生成 :video generation(abstract)
专题命中 视频生成 :text-to-video(abstract)
专题命中 视频生成 :video generation(abstract)
专题命中 视频生成 :video generation(abstract)
专题命中 视频生成 :text-to-video(abstract)
专题命中 视频生成 :video generation(abstract)
专题命中 视频生成 :video generation(abstract)
专题命中 视频生成 :video generation(abstract)
Journal ref npj Quantum Inf 7, 165 (2021)
专题命中 视频生成 :video generation(abstract)
Comments ICLR 2021
专题命中 视频生成 :video generation(abstract)
专题命中 视频生成 :video generation(abstract)
Comments 5 pages, 4 figures, Comments are welcome
Journal ref Sci. Adv. 5, eaav2761 (2019)
专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(title,abstract);long video(title,abstract);text-to-video(abstract)
Comments Project Page: https://yingqinghe.github.io/LVDM/ Github: https://github.com/YingqingHe/LVDM
面向鲁棒文本到视频生成的潜变量视频扩散模型腐蚀感知训练
机构 * William & Mary(威廉与玛丽学院) ; Carnegie Mellon University(卡内基梅隆大学) ; The University of Hong Kong(香港大学)
专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(title,abstract);text-to-video(title);video understanding(abstract)
AI总结 本文提出CAT-LVDM框架,通过结构化噪声注入提升视频扩散模型的鲁棒性,实验显示其在多个数据集上优于传统方法,且能扩展至自回归生成和多模态视频理解模型。
Comments ICLR 2026 ReALM-GEN
专题命中 视频扩散模型 :video diffusion(title,abstract);long video(title,abstract);video generation(abstract);text-to-video(abstract)
专题命中 视频扩散模型 :video diffusion(title,abstract);long video(title,abstract);video generation(abstract);分类 cs.CV、cs.MM
Comments This paper is accepted by CVPR 2025
专题命中 视频扩散模型 :video diffusion(title,abstract);text-to-video(title,abstract);video generation(abstract);分类 cs.CV、cs.MM
SKeDA:一种面向文本到视频扩散模型的生成水印框架
机构 * School of Electronic and Information Engineering, Anhui University(安徽大学电子与信息工程学院) ; Anhui Province Key Laboratory of Digital Security and the CAS Key Laboratory of Electromagnetic Space Information, University of Science and Technology of China(安徽省数字安全重点实验室和中国科学院电磁空间信息重点实验室,中国科学技术大学) ; School of Computing, National University of Singapore(新加坡国立大学计算机学院)
专题命中 视频扩散模型 :video diffusion(title,abstract);text-to-video(title,abstract);video generation(abstract);分类 cs.CV
AI总结 SKeDA是一种专为文本到视频扩散模型设计的生成水印框架,通过分布保持采样和差分注意机制提升水印的鲁棒性和可靠性。
Comments 11 pages, 6 figures
MagicMirror: 视频扩散变换器中的身份保留视频生成
专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(title,abstract);text-to-video(abstract);分类 cs.CV
AI总结 MagicMirror通过双分支特征提取器和两阶段训练策略,在视频扩散变换器中实现高质量身份保留视频生成,优于现有方法。
Comments ICCV 2025, It is best viewed in Acrobat. Project Page: https://julianjuaner.github.io/projects/MagicMirror/
专题命中 视频扩散模型 :video diffusion(title,abstract);text-to-video(title,abstract);video generation(abstract);分类 cs.CV
专题命中 视频扩散模型 :video generation(title,abstract);long video(title,abstract);video diffusion(abstract);分类 cs.CV
专题命中 视频扩散模型 :video diffusion(title,abstract);text-to-video(title,abstract);video generation(abstract);分类 cs.CV
Comments Accepted to TMLR | Project Page: https://unified-attention-control.github.io/
专题命中 视频扩散模型 :video diffusion(title,abstract);text-to-video(title,abstract);video generation(abstract);分类 cs.CV
Comments Accepted by NeurIPS 2024 (Datasets and Benchmarks Track)
专题命中 视频扩散模型 :video diffusion(title,abstract);long video(title,abstract);video generation(abstract);分类 cs.CV
Comments 21 pages
专题命中 视频扩散模型 :video generation(title,abstract);video diffusion(title,abstract);text-to-video(abstract);分类 cs.CV
Comments arXiv admin note: text overlap with arXiv:2307.04725 by other authors
专题命中 视频扩散模型 :text-to-video(title,abstract);video diffusion(title);video generation(abstract);long video(abstract)
Comments CVPR 2024