STAG4D: Spatial-Temporal Anchored Generative 4D Gaussians
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
Comments Project Page at https://magic-me-webpage.github.io
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments GitHub repository: https://github.com/PKU-YuanGroup/Envision3D
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
Comments Project web: https://enriccorona.github.io/vlogger/
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments Project Page: https://animate124.github.io
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments 16 pages, 9 figures
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
专题命中 视频扩散模型 :video understanding(abstract);分类 cs.CV
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
专题命中 视频扩散模型 :text-to-video(abstract);分类 cs.CV
专题命中 视频扩散模型 :long video(abstract);分类 cs.CV
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
Comments MedNeurIPS 2023 poster
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
Comments Method update: we proposed structure-based scaling to enhance the performance of FreeU. Project page: https://chenyangsi.top/FreeU/
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
Comments Submitted to IJCV
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
Comments Project Page: https://yanivnik.github.io/sinfusion
专题命中 视频扩散模型 :text-to-video(abstract);分类 cs.CV
Comments CVPR2023 Workshop on AI for Content Creation. Project Page: https://lifrary.github.io/AADiff/
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
Comments AAAI2023 https://kfmei.page/vidm/
专题命中 视频扩散模型 :video understanding(abstract);分类 cs.CV
专题命中 视频扩散模型 :long video(abstract);分类 cs.CV
高维流形假设下扩散模型的收敛性
专题命中 视频扩散模型 :video generation(abstract)
AI总结 该研究在流形假设下证明 DDPM 的分数学习和采样复杂度均实现与高维 ambient 空间维度无关的速率,通过建立扩散模型与高斯过程极值理论的新框架完成,解释了其经验成功。
Zellige:用于混合图像-视频DiT训练的可塑序列放置
专题命中 视频扩散模型 :video generation(abstract)
AI总结 Zellige是一种可塑序列放置系统,通过硬件分析器、两阶段规划器和合并注意力引擎解决混合图像-视频DiT训练的GPU序列放置问题,在多GPU环境下性能优于KnapFormer。
DSTAR:通过减少空间和时间冗余加速扩散变换器
专题命中 视频扩散模型 :video generation(abstract)
AI总结 研究针对扩散变换器多迭代推理低效耗能问题,提出软硬件协同设计框架DSTAR。算法上用细粒度混合精度量化和稀疏注意力重用机制,架构上设计专用硬件加速器,经评估在多个典型DiTs上实现显著延迟加速和节能,且不降低精度。
Comments Accepted to the 59th IEEE/ACM International Symposium on Microarchitecture (MICRO 2026)
预训练视频模型作为可微物理模拟器用于城市风流
机构 * ETH Zurich(苏黎世联邦理工学院) ; Tel Aviv University(特拉维夫大学) ; TU Darmstadt(达姆施塔特工业大学)
专题命中 视频扩散模型 :video diffusion(abstract)
AI总结 本文提出WinDiNet,一种预训练视频扩散模型,用于快速模拟城市风流,通过反向传播优化建筑布局以提升风安全性和行人舒适度。
Flow-DPPO:用于流匹配模型的散度近端策略优化
机构 * Xi’an Jiaotong University(西安交通大学) ; Tencent Hunyuan(腾讯混元) ; National University of Singapore(新加坡国立大学)
专题命中 视频扩散模型 :video generation(abstract)
AI总结 针对流匹配模型中PPO比率裁剪的结构性缺陷,提出Flow-DPPO方法,利用高斯策略的精确KL散度计算实现散度近端约束,提升奖励和训练稳定性。
释放无限运动:通过生成式视频先验扩展富有表现力的四足运动
机构 * Amap, Alibaba Group(高德,阿里巴巴集团)
专题命中 视频扩散模型 :video diffusion(abstract)
AI总结 提出Uni-Mo全自动流水线,利用LLM和视频扩散模型生成四足机器人运动数据,通过身份一致性损失提取3D轨迹,训练真实机器人跟踪策略,并发布包含7488个语言标注运动的数据集。
Pulse: 面向大规模扩散模型的自动流水线并行训练加速
专题命中 视频扩散模型 :video generation(abstract)
AI总结 提出PULSE自动流水线并行策略,通过将跳跃连接层同设备放置、局部缓存激活值,消除跨流水线通信,结合动态规划分区器、ILP调度合成器和混合并行调优器,在通信受限硬件上实现最高2.3倍吞吐提升。
Comments Accepted by International Conference on Distributed Computing Systems(ICDCS'26)