MatchDiffusion: Training-free Generation of Match-cuts
专题命中 视频扩散模型 :video diffusion(abstract);text-to-video(abstract);分类 cs.CV
Comments https://matchdiffusion.github.io
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
专题命中 视频扩散模型 :video diffusion(abstract);text-to-video(abstract);分类 cs.CV
Comments https://matchdiffusion.github.io
专题命中 视频扩散模型 :video diffusion(abstract);text-to-video(abstract);分类 cs.CV
Comments Code: https://github.com/hmrishavbandy/FlipSketch
专题命中 视频扩散模型 :video generation(abstract);video diffusion(abstract);分类 cs.CV
Comments NeurIPS 2024, Project page: https://donydchen.github.io/mvsplat360, Code: https://github.com/donydchen/mvsplat360
专题命中 视频扩散模型 :video generation(abstract);video diffusion(abstract);分类 cs.CV
Comments Accepted by NeurIPS 2024 Spotlight
专题命中 视频扩散模型 :video diffusion(abstract);long video(abstract);分类 cs.CV
Comments Accepted by ACM Transactions on Graphics and SIGGRAPH Asia 2024. Project page: https://luckyhzt.github.io/lvcd
专题命中 视频扩散模型 :video generation(abstract);text-to-video(abstract);分类 cs.CV
专题命中 视频扩散模型 :video generation(abstract);long video(abstract);分类 cs.CV
专题命中 视频扩散模型 :video diffusion(abstract);text-to-video(abstract);分类 cs.CV
专题命中 视频扩散模型 :video generation(abstract);long video(abstract);分类 cs.CV
Comments Project Page: https://zhengjun-ai.github.io/viton-dit-page/
专题命中 视频扩散模型 :video generation(abstract);video diffusion(abstract);分类 cs.CV
专题命中 视频扩散模型 :video generation(abstract);video diffusion(abstract);分类 cs.CV
Comments https://wangqiang9.github.io/Controllable.github.io/
专题命中 视频扩散模型 :video generation(abstract);video diffusion(abstract);分类 cs.CV
Comments First two authors contributed equally; Project page: https://ctrl-adapter.github.io/
专题命中 视频扩散模型 :video generation(abstract);text-to-video(abstract);分类 cs.CV
Comments Project page: https://research.nvidia.com/labs/toronto-ai/AlignYourGaussians/
专题命中 视频扩散模型 :video generation(abstract);text-to-video(abstract);分类 cs.CV
Comments Conference on Computer Vision and Pattern Recognition (CVPR) 2023. Project page: https://research.nvidia.com/labs/toronto-ai/VideoLDM/
专题命中 视频扩散模型 :video generation(abstract);video diffusion(abstract);分类 cs.CV
专题命中 视频扩散模型 :video diffusion(abstract);text-to-video(abstract);分类 cs.CV
Comments Project page: https://diffusion-motion-transfer.github.io/
专题命中 视频扩散模型 :video diffusion(abstract);long video(abstract);分类 cs.CV
Comments Project Page at https://showlab.github.io/magicanimate
专题命中 视频扩散模型 :video generation(abstract);text-to-video(abstract);分类 cs.CV
Comments The project is available at: https://github.com/Picsart-AI-Research/Text2Video-Zero
专题命中 视频扩散模型 :video generation(abstract);video diffusion(abstract);分类 cs.CV
Comments Project page at https://research.runwayml.com/gen1
专题命中 视频扩散模型 :video generation(abstract);text-to-video(abstract);分类 cs.MM
Comments Audio samples are available at https://Text-to-Audio.github.io
专题命中 视频扩散模型 :video generation(abstract);video diffusion(abstract);分类 cs.CV
Comments 9 pages, 2 tables, 7 figures
专题命中 视频扩散模型 :video generation(abstract);video diffusion(abstract);分类 cs.CV
Comments Published in TMLR (11/2022)
Adaptive-WAM:基于质量引导的中间视频扩散特征早期退出规划
专题命中 视频扩散模型 :video generation(abstract);video diffusion(abstract)
AI总结 Adaptive-WAM是基于Wan2.2-5B主干的质量感知多出口规划器,通过动态分配主干深度减少计算量,在NAVSIM、nuScenes等数据集上取得优异规划性能,延迟显著降低。
用于长期规划的带引导搜索的组合扩散
机构 * Georgia Institute of Technology(佐治亚理工学院)
专题命中 视频扩散模型 :video generation(abstract);long video(abstract)
AI总结 研究针对组合生成模型在局部分布多模态时的模式平均问题,提出带引导搜索的组合扩散方法(CDGS),通过特定采样、过滤和重采样解决问题,在机器人操作任务上表现出色且跨领域通用。
Comments 38 pages, 18 figures, ICLR 2026 ORAL
GF-DiT:扩散Transformer服务的并行调度
机构 * Shanghai Jiao Tong University(上海交通大学) ; Guizhou University(贵州大学)
专题命中 视频扩散模型 :video generation(abstract);video diffusion(abstract)
AI总结 提出GF-DiT,一种策略可编程运行时,通过动态调整请求并行度来优化扩散Transformer服务,利用无组集合通信实现低开销在线重配置,显著提升吞吐量和降低延迟。
粗到细的组合扩散用于长时域规划
机构 * KAIST(韩国科学技术院) ; Georgia Institute of Technology(佐治亚理工学院)
专题命中 视频扩散模型 :video generation(abstract);long video(abstract)
AI总结 提出Coarse-to-Fine Compositional Diffusion (CoFi)方法,通过先形成全局骨架再细化局部细节,在长时域机器人规划、全景图像生成和长视频生成中提升全局一致性和局部质量,同时减少2-8倍去噪评估次数。
Comments Project page: https://cofi-diffusion.github.io
DiT4DiT:联合建模视频动态与动作以实现通用机器人控制
机构 * Mondo Robotics(Mondo机器人公司) ; HKUST(GZ)(香港科技大学(广州)) ; HKUST(香港科技大学)
专题命中 视频扩散模型 :video generation(abstract);video diffusion(abstract)
AI总结 本文提出DiT4DiT模型,通过结合视频扩散变换器与动作扩散变换器,实现视频动态与动作的联合建模,提升机器人控制的泛化能力与样本效率。
Comments https://dit4dit.github.io/
euphonium:通过过程奖励梯度引导的随机动态控制视频流匹配
机构 * Huazhong University of Science and Technology(华中科技大学) ; Shanghai Jiao Tong University(上海交通大学) ; Tencent Hunyuan(腾讯混元) ; University of Chinese Academy of Sciences(中国科学院大学)
专题命中 视频扩散模型 :video generation(abstract);text-to-video(abstract)
AI总结 Euphonium通过过程奖励梯度引导动态,提升视频流匹配的生成效率和对齐性。
机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) ; Beijing Institute of Technology(北京理工大学) ; Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; Hunan University(湖南大学) ; Shanghai AI Lab(上海人工智能实验室) ; HEBUST
专题命中 视频扩散模型 :video understanding(abstract);分类 cs.CV、eess.IV、cs.MM
Comments Accepted to NeurIPS 2025. The dataset and code are available at https://github.com/KPeng9510/HopaDIFF
机构 * KAIST(韩国科学技术院) ; DeepBrain AI Inc.(DeepBrain AI公司)
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV、eess.IV、cs.MM
Comments ICCV 2025. Project page: https://deepbrainai-research.github.io/float/