S2DM: Sector-Shaped Diffusion Models for Video Generation
专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV
Comments 17 pages, 6 figures
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV
Comments 17 pages, 6 figures
专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV
专题命中 视频生成 :text-to-video(title,abstract);video generation(abstract);分类 cs.CV
专题命中 视频生成 :text-to-video(title,abstract);video generation(abstract);分类 cs.CV
Comments WACV'24 workshop
专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV
Comments project page: https://world-dreamer.github.io/
专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract);分类 cs.CV
Comments project page: https://showlab.github.io/Moonshot/
专题命中 视频生成 :video-language(title,abstract);text-to-video(abstract);分类 cs.CV
专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV
Comments Project page: https://hhsinping.github.io/factor
专题命中 视频生成 :text-to-video(title,abstract);video generation(abstract);分类 cs.CV
Comments Project page: https://flowzero-video.github.io
专题命中 视频生成 :text-to-video(title,abstract);video diffusion(abstract);分类 cs.CV
Comments Project page: https://livesketch.github.io/
专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV
Comments 12 pages
专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV
Comments Tech Report; Github: https://github.com/AILab-CVC/VideoCrafter Homepage: https://ailab-cvc.github.io/videocrafter/
专题命中 视频生成 :text-to-video(title,abstract);video generation(abstract);分类 cs.CV
Comments NeurIPS 2023; Project available at: https://github.com/SooLab/Free-Bloom
专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV
专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV
Comments Github: https://github.com/VideoCrafter/Animate-A-Story Project page: https://videocrafter.github.io/Animate-A-Story
专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV
Comments 13 pages, 8 figures. Project page: https://doubiiu.github.io/projects/Make-Your-Video/
专题命中 视频生成 :text-to-video(title,abstract);video generation(abstract);分类 cs.CV
Comments 9 pages, 8 figures
专题命中 视频生成 :video generation(title,abstract);long video(abstract);分类 cs.CV
专题命中 视频生成 :video-language(title,abstract);text-to-video(abstract);分类 cs.CV
专题命中 视频生成 :video generation(title,abstract);long video(abstract);分类 cs.CV
专题命中 视频生成 :video-language(title,abstract);text-to-video(abstract);分类 cs.CV
Journal ref published in CVPR 2022
专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract);分类 cs.CV
RAVEN-Eval:基于大语言多模态模型(LMM)偏好判断的、采用评分准则引导的AI视频生成模型自动评估框架
专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract)
AI总结 本文提出RAVEN-Eval框架,基于LMM偏好判断与评分准则引导,可自动评估AI视频生成模型,已筛选任务、收集数据、评估模型与LMM并建立排行榜,为AIVGMs评估提供可扩展路径。
将音乐带入视野:音乐驱动的360°视频生成
机构 * National Yang Ming Chiao Tung University(国立阳明交通大学)
专题命中 视频生成 :video generation(title,abstract);分类 cs.CV、eess.IV、cs.MM
AI总结 【一句话总结】该研究针对音乐可视化问题,提出情感感知的音乐驱动360°视频生成流程,先预估歌曲情感轨迹,再转化为视觉引导,经SEGA框架生成关键帧,最后合成视频,能反映歌曲情感与结构。
Comments 5 pages, 1 figure
动作代理:代理视频生成与流约束扩散的结合
机构 * Intelligent Space Robotics Laboratory, Skoltech(斯克里普切尔技术大学智能空间机器人实验室)
专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract)
AI总结 本文提出Action Agent框架,结合代理导航视频生成与流约束扩散控制,通过两阶段方法提升多体机器人导航性能,实现从语言和图像输入生成物理合理的第一人称导航视频,并在真实和仿真环境中取得高成功率。
Comments 8 pages, 5 figures
LAViG-FLOW:用于流体流动模拟的潜在自回归视频生成
专题命中 视频生成 :video generation(title,abstract);video diffusion(abstract)
AI总结 LAViG-FLOW通过潜在自回归视频生成框架高效模拟流体流动,实现比传统方法快百倍的饱和度和压力场生成。
专题命中 视频生成 :video generation(title,abstract);text-to-video(abstract)
Comments 8 pages, 8 figures, 1 table
专题命中 视频生成 :text-to-video(title,abstract);video diffusion(abstract)
Comments Project website https://video-adapter.github.io/. First two authors contributed equally
专题命中 视频生成 :video generation(title,abstract);分类 cs.CV;video diffusion(comments)
Comments 3D stereoscopic video generation, video diffusion, inpainting
Delta Forcing:交互式自回归视频生成中的信任区域引导
机构 * Texas A\&M University(德克萨斯A&M大学) ; University of Washington(华盛顿大学)
专题命中 视频生成 :video generation(title,abstract);分类 cs.CV、cs.MM
AI总结 本文提出Delta Forcing方法,通过约束不可靠的教师监督在适应性信任区域中,以提高自回归视频生成的一致性并保持对新事件的响应性。
Comments preprint